📡 Linux.do 频道日报 · 夜报
有效消息 159 条
📡 Linux.do 频道日报 · 2026-09-02
单一频道综合 · 已去重整理
一、今日要闻
1. Gemini 3.8 Flash API 被多名用户发现上线,灰度范围与实际质量待验证
• 频道内出现“Gemini 3.8 Flash API 已可用”的信息,也有用户称模型自报版本从 3.7 Flash 变为 3.8。
• 目前 AI Studio 等入口是否全面开放、未登录与不同订阅账号能否调用,尚无统一结论。
• 多名用户同时反馈 Gemini Flash 响应偏慢、反代接入 IDE 后出现结巴、英文输出或“只说不做”等问题。
• 影响:Gemini 新版能力正在成为开发者的关注点,但 API 可用性、模型路由和客户端兼容性仍需实测。
2. OpenAI Codex 额度、模型降级与客户端异常集中爆发
• 多位用户称 Codex 20x 周额度波动明显:有人的预估额度从约 3600 降至 3000、2500、2000;也有人看到不同账号在约 20 美元至 215 美元间出现巨大差异。
• GPT-5.6 Sol 被反馈可能在复杂任务中自动拉起大量子智能体;个案中一次“盲审”持续数小时,周额度从约 50% 降至 10%。
• Codex 更新后还出现会话显示层丢失、VS Code 客户端缺少分支与重编辑按钮、频繁升级拖慢启动等问题;部分用户讨论 5 小时额度究竟是固定时间刷新还是首次使用后滚动计算。
• 影响:高阶 Agent 的并行能力可能显著放大消耗,用户需要关注模型、工具调用和子任务权限,而不能只按聊天轮数估计成本。
3. ChatGPT 网页端“降智”识别方式变化,用户转向网络请求字段判断
• 有用户称,过去通过直接询问模型身份来判断 Pro 是否被路由到 mini 模型的方法已失效:疑似降级模型会自称高阶 Pro。
• 社区流传的新观察方法是查看网页开发者工具中的网络请求字段,检查会话是否出现
• 也有经验称,不同网络出口与浏览器会话状态可能影响体验,但这属于用户侧观察,并非官方机制说明。
• 影响:模型实际路由、额度和性能变得不透明,用户对“订阅档位是否兑现”的质疑持续增加。
4. Claude 订阅封号与跨地区支付问题仍未缓解
• 有用户称 Claude 账号刚开通、尚未发送消息,仅配置进代理或聚合工具后即被封;另有用户咨询通过 Apple、Google Pay 或虚拟卡订阅的可行性与退款风险。
• 社区普遍担忧多人拼车、跨设备登录、代理出口变更、第三方中转等行为触发风控。
• 对“低价区”“二手年费号”“代订阅”渠道,已有交易后服务被禁、卖家归因网络问题的案例讨论。
• 影响:账号资产的稳定性正成为订阅决策核心,低价不再等于低总成本。
5. 多家 AI 服务调整免费策略:B.AI 即将收费,MiMo 内测进入倒计时
• B.AI 宣布 DeepSeek V4 Flash 与 Vision Exp 将于 9 月 3 日 17:00(SGT)结束免费体验,转为官方价格五折;GLM 5.3 Flash、Qwen 3.8 Flash、Hy3、MiMo V2.5 等据称仍维持免费开放。
• 用户指出 B.AI 免费模型高峰时段曾频繁出现 403,免费服务的稳定性并不理想。
• MiMo-V2.5-Pro-UltraSpeed 限时体验将于 9 月 8 日停止:API 与在线体验同步下线,正式商业版预计后续推出。
• 影响:免费模型正在从“长期入口”转向阶段性获客工具,开发者应预留迁移、降级与预算方案。
6. 本地长上下文小模型的显存门槛被实测量化
• 用户测试讯飞 Spark-X2.5 1.7B、4B 长上下文模型,认为小模型适合个人设备运行,但 1M 上下文的 KV Cache 依然带来高显存需求。
• 在 RTX 5070 Ti 16GB 条件下,若将 KV Cache 保持在显存中,1.7B 模型上下文约可到 450K,4B 约可到 170K。
• 若拉满 1M 上下文,默认配置下 1.7B 至少需约 31.12GB 显存,4B 约需 52.55GB。
• 影响:参数量小不意味着长上下文部署轻量;选择本地模型时,显存与缓存策略需和模型大小一并评估。
7. 反代与开发工具的“慢”和“贵”,往往不只由模型决定
• 有用户排查海外反代长会话 TTFT 过高,发现问题主要来自国内到新加坡后端的上行带宽过低:长文本及图片上传耗时数分钟,而后端面板显示模型处理只需十余秒。
• 通过为后端域名单独分流到新加坡节点后,长会话的实际首字延迟降至十余秒。
• 另有 VS Code Copilot 用户发现,同一会话的代码引用在请求中时而省略、时而完整展开,造成缓存无法稳定命中,费用快速增长。
• 影响:排查 AI 开发体验应同时观察网络上传、请求体大小、缓存命中率、工具行为与模型推理速度。
8. 平台与软硬件更新:Google Pics、豆包工作、苹果生态均有新动作
• Google Pics 将在未来数周面向 Google AI Pro、Ultra 用户及多数 Workspace 企业客户推出,基于 Nano Banana 图像生成与编辑模型,并将先后整合至 Slides、Docs、Drive。
• 豆包工作新增多智能体并行:主智能体拆分任务交由子智能体并发执行;同时将“操作电脑”能力扩展至 Mac,可识别界面并完成点击、填写等操作。
• 苹果允许要求 macOS 13 或更高版本的通用 Mac App Store 应用停止支持 Intel Mac;报道称 macOS Tahoe 将是最后支持 Intel Mac 的系统版本,后续 Golden Gate 将面向 Apple Silicon。
• 影响:生产力 AI 正在从单轮问答走向工具协同与桌面自动化,Intel Mac 的软件生命周期则进一步收缩。
二、分主题深读
🤖 AI 模型、API 与推理成本
• Quasar 438B 发布:Multiverse Computing 推出面向企业智能体与编程任务的大模型 Quasar 438B,支持英语、西班牙语。据其公布的数据,该模型在 Artificial Analysis Intelligence Index v4.1.1 获得 43 分,较 Mistral Medium 3.5 的 30 分高 13 分,并被定位为该榜单得分最高的欧洲模型。
• GLM 与 DeepSeek 的免费资源受限:用户发现 OpenRouter 中存在 GLM 5.2 free,但实际调用拥堵;B.AI 的 DeepSeek V4 Flash 即将转收费,也再次说明“免费”模型在高峰期常伴随限流、排队或可用性风险。
• Ollama Pro 老套餐的价值争议:一项以约 150K token 大请求进行的非官方测试称,老套餐在 DeepSeek V4 Flash 场景下月度可用价值约 360 美元,相比新套餐差距明显;但缓存完全命中的测试会高估现实表现,数据仅可作为量级参考。
• Fable 与高并发 Agent 的消耗警报:有用户称 Fable 5.1 简单做网页界面排查便迅速耗尽配额,估算消耗速度约为 Opus 5 的 20 倍;DeepSeek Harness 也被观察到按冲突文件并发开启 workflow,瞬时并发可达数十路。
• 输出控制成为使用技能:社区讨论认为,面对模型默认“大而全”的回答,应通过自定义指令要求先给结论、再按需展开,避免过长清单占用注意力,也能减少不必要的上下文和 token 支出。
🧑💻 AI 编程、IDE 与本地部署
• 三款 AI IDE 国内外版本存在账号与额度隔离:Trae、CodeBuddy、Qoder 的国内版与国际版注册方式、免费额度、付费入口均不同。国际版多使用 Google、GitHub、邮箱等方式登录;国内版更依赖手机号、抖音、Apple ID 或企业账号。用户在选型时应先确认所需模型、云端任务并发数及地区可用性。
— message 1 of 2 —
有效消息 159 条
📡 Linux.do 频道日报 · 2026-09-02
单一频道综合 · 已去重整理
今日一句话:社区讨论高度聚焦 AI 订阅、Codex/Claude/Gemini 的额度与稳定性,以及本地部署和反代链路的实际体验;“低价渠道”背后的封号、降级、计费失控与服务变更,成为比模型能力更突出的共同焦虑。
一、今日要闻
1. Gemini 3.8 Flash API 被多名用户发现上线,灰度范围与实际质量待验证
• 频道内出现“Gemini 3.8 Flash API 已可用”的信息,也有用户称模型自报版本从 3.7 Flash 变为 3.8。
• 目前 AI Studio 等入口是否全面开放、未登录与不同订阅账号能否调用,尚无统一结论。
• 多名用户同时反馈 Gemini Flash 响应偏慢、反代接入 IDE 后出现结巴、英文输出或“只说不做”等问题。
• 影响:Gemini 新版能力正在成为开发者的关注点,但 API 可用性、模型路由和客户端兼容性仍需实测。
2. OpenAI Codex 额度、模型降级与客户端异常集中爆发
• 多位用户称 Codex 20x 周额度波动明显:有人的预估额度从约 3600 降至 3000、2500、2000;也有人看到不同账号在约 20 美元至 215 美元间出现巨大差异。
• GPT-5.6 Sol 被反馈可能在复杂任务中自动拉起大量子智能体;个案中一次“盲审”持续数小时,周额度从约 50% 降至 10%。
• Codex 更新后还出现会话显示层丢失、VS Code 客户端缺少分支与重编辑按钮、频繁升级拖慢启动等问题;部分用户讨论 5 小时额度究竟是固定时间刷新还是首次使用后滚动计算。
• 影响:高阶 Agent 的并行能力可能显著放大消耗,用户需要关注模型、工具调用和子任务权限,而不能只按聊天轮数估计成本。
3. ChatGPT 网页端“降智”识别方式变化,用户转向网络请求字段判断
• 有用户称,过去通过直接询问模型身份来判断 Pro 是否被路由到 mini 模型的方法已失效:疑似降级模型会自称高阶 Pro。
• 社区流传的新观察方法是查看网页开发者工具中的网络请求字段,检查会话是否出现
gpt-5-6-thinking 等模型标识。 • 也有经验称,不同网络出口与浏览器会话状态可能影响体验,但这属于用户侧观察,并非官方机制说明。
• 影响:模型实际路由、额度和性能变得不透明,用户对“订阅档位是否兑现”的质疑持续增加。
4. Claude 订阅封号与跨地区支付问题仍未缓解
• 有用户称 Claude 账号刚开通、尚未发送消息,仅配置进代理或聚合工具后即被封;另有用户咨询通过 Apple、Google Pay 或虚拟卡订阅的可行性与退款风险。
• 社区普遍担忧多人拼车、跨设备登录、代理出口变更、第三方中转等行为触发风控。
• 对“低价区”“二手年费号”“代订阅”渠道,已有交易后服务被禁、卖家归因网络问题的案例讨论。
• 影响:账号资产的稳定性正成为订阅决策核心,低价不再等于低总成本。
5. 多家 AI 服务调整免费策略:B.AI 即将收费,MiMo 内测进入倒计时
• B.AI 宣布 DeepSeek V4 Flash 与 Vision Exp 将于 9 月 3 日 17:00(SGT)结束免费体验,转为官方价格五折;GLM 5.3 Flash、Qwen 3.8 Flash、Hy3、MiMo V2.5 等据称仍维持免费开放。
• 用户指出 B.AI 免费模型高峰时段曾频繁出现 403,免费服务的稳定性并不理想。
• MiMo-V2.5-Pro-UltraSpeed 限时体验将于 9 月 8 日停止:API 与在线体验同步下线,正式商业版预计后续推出。
• 影响:免费模型正在从“长期入口”转向阶段性获客工具,开发者应预留迁移、降级与预算方案。
6. 本地长上下文小模型的显存门槛被实测量化
• 用户测试讯飞 Spark-X2.5 1.7B、4B 长上下文模型,认为小模型适合个人设备运行,但 1M 上下文的 KV Cache 依然带来高显存需求。
• 在 RTX 5070 Ti 16GB 条件下,若将 KV Cache 保持在显存中,1.7B 模型上下文约可到 450K,4B 约可到 170K。
• 若拉满 1M 上下文,默认配置下 1.7B 至少需约 31.12GB 显存,4B 约需 52.55GB。
• 影响:参数量小不意味着长上下文部署轻量;选择本地模型时,显存与缓存策略需和模型大小一并评估。
7. 反代与开发工具的“慢”和“贵”,往往不只由模型决定
• 有用户排查海外反代长会话 TTFT 过高,发现问题主要来自国内到新加坡后端的上行带宽过低:长文本及图片上传耗时数分钟,而后端面板显示模型处理只需十余秒。
• 通过为后端域名单独分流到新加坡节点后,长会话的实际首字延迟降至十余秒。
• 另有 VS Code Copilot 用户发现,同一会话的代码引用在请求中时而省略、时而完整展开,造成缓存无法稳定命中,费用快速增长。
• 影响:排查 AI 开发体验应同时观察网络上传、请求体大小、缓存命中率、工具行为与模型推理速度。
8. 平台与软硬件更新:Google Pics、豆包工作、苹果生态均有新动作
• Google Pics 将在未来数周面向 Google AI Pro、Ultra 用户及多数 Workspace 企业客户推出,基于 Nano Banana 图像生成与编辑模型,并将先后整合至 Slides、Docs、Drive。
• 豆包工作新增多智能体并行:主智能体拆分任务交由子智能体并发执行;同时将“操作电脑”能力扩展至 Mac,可识别界面并完成点击、填写等操作。
• 苹果允许要求 macOS 13 或更高版本的通用 Mac App Store 应用停止支持 Intel Mac;报道称 macOS Tahoe 将是最后支持 Intel Mac 的系统版本,后续 Golden Gate 将面向 Apple Silicon。
• 影响:生产力 AI 正在从单轮问答走向工具协同与桌面自动化,Intel Mac 的软件生命周期则进一步收缩。
二、分主题深读
🤖 AI 模型、API 与推理成本
• Quasar 438B 发布:Multiverse Computing 推出面向企业智能体与编程任务的大模型 Quasar 438B,支持英语、西班牙语。据其公布的数据,该模型在 Artificial Analysis Intelligence Index v4.1.1 获得 43 分,较 Mistral Medium 3.5 的 30 分高 13 分,并被定位为该榜单得分最高的欧洲模型。
• GLM 与 DeepSeek 的免费资源受限:用户发现 OpenRouter 中存在 GLM 5.2 free,但实际调用拥堵;B.AI 的 DeepSeek V4 Flash 即将转收费,也再次说明“免费”模型在高峰期常伴随限流、排队或可用性风险。
• Ollama Pro 老套餐的价值争议:一项以约 150K token 大请求进行的非官方测试称,老套餐在 DeepSeek V4 Flash 场景下月度可用价值约 360 美元,相比新套餐差距明显;但缓存完全命中的测试会高估现实表现,数据仅可作为量级参考。
• Fable 与高并发 Agent 的消耗警报:有用户称 Fable 5.1 简单做网页界面排查便迅速耗尽配额,估算消耗速度约为 Opus 5 的 20 倍;DeepSeek Harness 也被观察到按冲突文件并发开启 workflow,瞬时并发可达数十路。
• 输出控制成为使用技能:社区讨论认为,面对模型默认“大而全”的回答,应通过自定义指令要求先给结论、再按需展开,避免过长清单占用注意力,也能减少不必要的上下文和 token 支出。
🧑💻 AI 编程、IDE 与本地部署
• 三款 AI IDE 国内外版本存在账号与额度隔离:Trae、CodeBuddy、Qoder 的国内版与国际版注册方式、免费额度、付费入口均不同。国际版多使用 Google、GitHub、邮箱等方式登录;国内版更依赖手机号、抖音、Apple ID 或企业账号。用户在选型时应先确认所需模型、云端任务并发数及地区可用性。
— message 1 of 2 —