📡 Linux.do 频道日报 · 午报
有效消息 283 条

📡 Linux.do 频道日报 · 2026-08-21
单频道综合 · 已去重整理

今日一句话:频道讨论被两条主线贯穿——一边是 Codex、ChatGPT 与 OpenCode 的额度、路由和稳定性争议集中爆发;另一边是匿名模型 Ox Alpha、DeepSeek Harness 等新工具引发密集实测,用户正从“哪个模型更强”转向“如何稳定、合规、可管理地使用 Agent”。


一、今日要闻

1. ChatGPT / Codex 出现“降智、错路由、额度异常”集中反馈
• 多名用户称 ChatGPT 网页端无论选择 GPT-5.5、GPT-5.6、o3 或不同思考模式,实际回答疑似被统一路由至 GPT-5.5-mini,表现为回复异常快、复杂任务无法继续执行。
• 部分 Plus、5x、20x 用户同时反馈周额度消耗明显加快,个别账号重置后可用额度仅为原来的约 20%,也有人报告 20x 少量提问即消耗约 10%。
• 也有反向反馈称,Codex 前一日大面积异常后,8 月 21 日部分 Team 账号的额度消耗已恢复至“每次约掉 1%”的正常体感。
• 影响:问题可能涉及账户风险标记、模型路由、套餐策略或服务端故障,社区尚无统一结论;不同账号、客户端、网络环境的结果明显不一致。

2. Codex 0.149.0 更新带来上下文提升,也曝出鉴权兼容问题
• 有用户发现新版 Codex 中 GPT-5.6 系列默认上下文已提升至约 872,000 tokens,对应提交已被纳入当天发布的 0.149 版本。
• 同时有中转用户排查发现,Codex 0.149.0 某些请求可能丢失 Authorization 请求头,导致上游返回 401 Unauthorized;换密钥无效,Nginx 日志显示请求未携带 token。
• 社区还在讨论 Codex 多线程开发时如何隔离不同任务的 Git 改动,核心建议方向是以独立 worktree、分支或目录隔离 Agent 会话,而非让多个对话直接混改同一工作区。
• 影响:新版能力增强与兼容性风险并存,依赖中转、自建网关或特定代理链路的用户应先小范围验证。

3. OpenCode 停止 DeepSeek V4 Flash 免费推广,低价模型入口收缩
• 多位用户确认,OpenCode 内的 DeepSeek V4 Flash Free 已无法继续调用,提示免费推广结束,需订阅 OpenCode Go 才能使用。
• 该模型此前常被用作低成本代码审查、轻量开发和日常问答,因此不少用户直言“免费模型没了”。
• 同日还有 WorkBuddy 国际版新增 GPT-5.6、Hy3 出现隐性额度,以及多个 Coding Plan 套餐“限额不透明、对话未完成即触顶”的吐槽。
• 影响:免费和低价供给进一步减少,开发者开始更看重套餐的真实可用轮次、并发、峰值限流和稳定性,而非名义额度。

4. 匿名免费模型 Ox Alpha 引发高热度测试,身份指向智谱新多模态系列
• Ox Alpha 在 OpenCode / OpenRouter 侧以免费匿名模型出现,用户用“鹈鹕骑自行车”“大雁骑自行车”“秦始皇骑北极熊”、黑洞网页和 3D 建模等提示词测试,普遍认为其 HTML、SVG、前端视觉生成能力突出。
• 有用户通过上游报错比对发现,Ox Alpha 与智谱国际站均返回相同的 top_p parameter is illegal [0,1] 错误码与措辞,据此认为其已可较高概率确认属于 智谱新系列多模态模型。
• 也有人结合小米 9 月 10 日可能举行的发布活动,推测其可能与 MiMo V3 有关;这一说法目前仍属社区猜测,未获官方确认。
• 影响:模型身份未正式披露前,测试结果只能作为体验参考;但其前端生成、视觉补全和网页交付能力已成为当天最受关注的实测方向。

5. DeepSeek Harness 生态持续扩张,灰测能力与源码线索受关注
• 多名用户讨论 DeepSeek Harness 与 Codex Harness 开源后,Agent 开发是否应继续从 LangChain、LangGraph 学起,还是直接基于 Harness 二次开发。
• 有用户称通过设置 Harness 的用户与会话标识,在 Kimi Code 等环境触发 DeepSeek 灰测模型,并在科学计算优化任务中发现此前 GPT-5.6、Fable、Opus 5 未发现的优化点。
• 源码中还被发现 deepseek-v4-flash-vision-exp 字样,引发对视觉实验模型的猜测;另有用户展示灰测模型生成 3D 城市发条八音盒的案例。
• 影响:Harness 正从“调用模型的工具”变成 Agent 编排、记忆共享、任务审计和本地工作流的重要基础设施。

6. Claude Code 被发现默认启用 Remote Control,需留意会话控制范围
• 用户称 Claude Code v2.1.238 更新后,会话右下角出现 /rc active,经排查疑似默认开启了 Remote Control。
• 更新内容涉及远程控制断线重试、多设备模型与推理配置同步、HTTP 403 容错等,但用户认为更新说明未充分强调默认状态的变化。
• 如不希望默认启用,帖子给出的处理方式是执行 /config,将 Enable Remote Control for all sessions 设为 false。
• 影响:远程控制提升跨设备协作便利,但涉及会话、环境和权限边界时,应明确了解默认授权状态。

7. Google AI Pro 学生优惠重新成为热点,付款资料地区是关键变量
• 多位用户称此前验证过学生身份的账号可能再次领取一年 Google AI Pro 优惠,但有人页面显示的是 Google AI Plus 而非 Pro。
• 社区经验显示,Google 钱包、Play 和订阅中的历史地区付款资料可能影响优惠归属;删除其他国家资料、仅保留美国付款资料后,部分用户刷新页面成功变为 Pro。
• 也有用户通过 Google Play 绑定国内 Visa 卡完成验卡,但个案不代表通用结果;另有人删除玻利维亚付款资料后虽然领到优惠,却收到了 GPT 订阅续费取消邮件。
• 影响:跨区付款资料存在订阅联动和账户风控风险,操作前应确认现有订阅、支付方式与退款规则。

8. 本地部署热度上升:Qwen3.8-27B 成为高频讨论对象
• 有实验室用户计划利用闲置的 8×A6000 服务器部署 Qwen3.8-27B、DeepSeek V4 Flash 等模型,但也提出更实际的问题:本地模型除“尝鲜”外,如何进入日常工作流。
• 实测案例包括:单张 RTX 5880 Ada 跑 Qwen3.8-27B Q6 量化,在 512K 上下文 下约 50~60 tokens/s;两张 RTX 5090 同时运行 Q5 量化版本,解码约 100 tokens/s。
• 部署侧也暴露兼容难题:L20 机器受限于 CUDA 12.2 与旧驱动,难以直接使用依赖 CUDA 12.9 / 13.0 的新版 vLLM;双 4090 部署 FP8 参数设置也在求助。
• 影响:本地部署的门槛已从“能否跑起来”转向显存规划、驱动栈、量化质量、上下文长度和真实任务收益。

二、分主题深读

🤖 AI 模型、Agent 与开发工作流
• Harness 还是 LangChain / LangGraph? 社区讨论认为,两条路线并不互斥:LangChain、LangGraph 适合学习工作流编排、状态管理和工具调用的通用原理;Harness 更贴近当前编码 Agent、终端执行、会话恢复和真实工程任务。对新手而言,先建立 Agent 评估、任务拆解、权限控制与可观测性意识,比单纯追逐框架更重要。
• 多 Agent 统一归档成为实际需求:频繁切换 Codex、Claude、DeepSeek、OpenCode 等工具的用户,希望自动汇总历史对话、提示词、产物与项目上下文,最终沉淀为个人知识库。GitHub 私有仓库被视作可控的底座,但手工整理成本高,自动导出、会话标签、全文检索和项目级关联仍是痛点。
— message 1 of 3 —