📡 Linux.do 频道日报 · 早报
有效消息 165 条

📡 Linux.do 频道日报 · 2026-09-13
多源综合 · 已去重整理

今日主线:频道讨论高度集中在 ChatGPT、Codex 与多款模型的“降智”、额度缩水和服务不稳定,用户开始转向 DeepSeek V4.1 Flash、GLM 5.3 Flash、Claude 以及多种 Coding Plan 寻找替代方案。与此同时,智谱 ZCode 突然多次发放 3 亿 Token,AI 编程、Agent 编排、上下文管理和本地部署继续成为技术讨论重点。


一、今日要闻

1. ChatGPT 与 Codex 持续出现降智、额度缩水争议
• 多名用户反馈,重置后 GPT-6 Astra、Codex、GPT-5.6 等模型的表现明显下降,出现不遵守指令、重复输出、目录识别错误、代码漏改、编译失败和长时间“无法思考”等问题。
• 有用户称 Pro 20x 重置后的周额度只有约 1350,较此前约 1500 进一步下降;另有用户报告重置后额度快速消耗,短时间内下降至一半。
• 频道内也有人观察到,不同账号、地区、IP 和使用方式可能对应不同额度与模型质量,但目前没有形成明确、可复现的因果结论。
• 影响:高强度依赖 Codex 或网页端 GPT 的开发者,正在重新评估 Pro、Team、Plus 以及中转服务的性价比。

2. “降智”可能与限流、模型路由及账号状态有关,但仍缺乏官方解释
• 用户报告网页版 ChatGPT、Codex、WorkBuddy、第三方中转和不同模型之间表现不一致:有的账号网页端尚可,Codex 却明显变差;有的用户切换到 Astra、Luna 或其他模型后仍然感觉能力下降。
• 部分测试涉及固定提示词、代码修改、复杂场景生成和多轮 Agent 任务,反馈普遍认为模型并非单纯“回答风格变化”,而是存在执行完整度和可靠性下降。
• 也有用户认为,缓存命中率、上下文长度、并发、推理强度和服务高峰可能共同影响结果,不能仅凭单次测试判断模型本身退化。

3. ZCode 多次发放 3 亿 Token,领取和有效期存在波动
• 多名用户在夜间和周末再次看到智谱 ZCode 发放约 3 亿 Token,部分账号即使没有套餐也能领取,另有用户报告同一账号或多个账号连续获得额度。
• 频道反馈显示,额度可能分批弹出,且存在领取后消失、到期时间不同、已经领取却无法调用等情况;有人先领取 1 亿,随后又出现 3 亿,但后者后来不再显示。
• 一些用户在切换公益站、官方渠道或外部 Agent 后遇到调用报错,测活正常并不代表赠送额度一定能正常使用。
• 建议:把赠送额度视为临时活动,不要据此安排长期工作流;重要代码仍应保留本地和远程仓库备份。

4. DeepSeek V4.1 Flash 成为频道重点替代方案
• 讨论集中在 V4.1 Flash 的代码能力、Agent 适配、思考强度和长上下文性能。有人认为它在复杂代码修改上仍可能出现漏改、重复调用工具或编译不过,也有人认为经过合适的提示词、模式和工作流约束后,性价比明显优于高价模型。
• 一项频道内测试称,V4.1 Flash 的 High 思考强度在某些 DeepSWE 测试中优于 Max,甚至超过 Astra;但这属于社区测试结果,尚不足以概括所有任务。
• 技术报告解读显示,Reasoning Effort 并非简单的三档模型切换,而是底层连续标量;API 中的 low、high、max 更像预设值,用于调节模型愿意投入的思考长度。
• 长上下文方面,有用户反馈超过 100K 后 TPS 明显下降,接近 200K 时约为每秒 50 Token 左右,官方 API 也观察到类似现象。

5. AI Coding Plan 的价格、限额与退款体验引发集中讨论
• Ollama Pro 用户反馈,20 美元档虽然标称拥有更高额度,但部分模型出现思维链超过数分钟中断、工具反复调用和一次修改消耗大量额度的情况,申请全额退款成功。
• WorkBuddy 学生额度被指在使用 DeepSeek V4.1 Flash 不到一小时后触顶,用户开始比较 CommandCode、CodeBuddy、ZCode、火山方舟和其他 Coding Plan。
• 有用户认为 CommandCode Go 的模型质量优于部分免费或低价渠道,但实际使用中单个任务仍可能消耗约 7% 套餐额度,缓存命中率较高也不能完全抵消消耗。
• 频道还讨论了 CPA 并发限制、Ultra Subagent 是否计入并发、多个账号是否需要分别限制,以及如何让 Codex 与网页端 GPT 协作。

6. Codex 远程连接速度改善,但线程通信仍有故障
• 部分用户表示,最近一次 Codex 重置后,手机 App、Windows 和 macOS 之间的远程连接速度明显提升,从过去约 30 秒至 2 分钟缩短到约 4 至 7 秒。
• 另一方面,Codex 多线程或父子线程之间出现消息无法传递的问题:子线程重复旧上下文,父线程收不到任务完成回传,导致 Agent 循环执行或重复派发。
• 有用户分享了 Claude Code 接入 DeepSeek 后的跨会话通信案例,发送方会话能够唤醒处于挂起状态的接收方,说明多 Agent 协作在工具支持到位时具有实际可行性。

7. AI 生成小游戏和复杂场景的实践继续升温
• 频道出现多个 AI 辅助开发案例,包括复刻童年陨石游戏、生成 3D 箱庭小镇、制作 HTML 与 SVG 动画,以及利用 AI 生成游戏音乐。
• 对比测试普遍关注模型是否能处理昼夜变化、动态元素、地形高低、数值平衡和交互细节,而不是只看一次生成的视觉效果。
• 有开发者担心模型直接修改大型项目时出现删库风险。一名用户报告 DeepSeek V4.1 Flash 在 WorkBuddy 中执行任务后险些破坏数月内容,提醒使用 Agent 前应启用 Git、远程仓库和自动备份。

8. 云服务、支付与账号验证问题仍然频繁
• 甲骨文云注册继续出现风控拒绝,讨论涉及地区、信用卡类型、IP、家宽和资料填写方式,但成功案例与失败案例差异很大,暂无稳定通用方案。
• Giffgaff 退款事件出现进展:用户向 Ombudsman 投诉后获得退款及部分善意补偿,另有人遇到重复入账,退款流程和支付方式仍需逐笔核对。
• Apple、Google Play、ChatGPT 订阅和开发者账号均有支付审核或拒付案例,包括自动续费失败、订阅需人工审核、Apple Developer 99 美元账户无法购买、银行卡被拒等。
• 涉及支付方式、地区和账号验证的经验具有时效性,不能据个别成功案例推断长期稳定。

二、分主题深读

🤖 AI 模型与推理体验

• Astra、Luna 与 Codex 的体验分化:部分用户认为 Luna Max 在简单项目上足够使用,且高倍率调用不会明显消耗周额度;但也有人反馈 Luna 首字延迟达到约 50 秒。Astra 则被多次指责出现目录理解错误、执行任务缩水和长时间无法思考。

• GPT-5.3-Codex-Spark 可能退役:频道转述称该模型可能在下周停止服务,目前尚无官方公告被引用确认。用户正在比较 Spark、Luna、Astra 以及 Claude 系列的能力和成本。

• GLM 5.3 Flash 的稳定性争议:一方面,ZCode 的免费额度让用户能够低成本进行大规模测试;另一方面,部分用户认为模型容易重复调用工具、输出不完整,甚至无法完成极端长文本任务。免费额度的可用性和有效期也被认为不稳定。

• Grok、Gemini 与 Claude:有用户认为 Grok 新版本已经无法回到刚发布时的惊艳表现;Antigravity 中的 Claude 和 Gemini 也被批评存在输出不完整、限制较多等情况。另有用户咨询 Claude Desktop、Claude Code 的历史会话继承和插件故障。

🧑‍💻 AI 编程、Agent 与上下文管理

• 上下文筛选成为新的优化方向:频道内一篇技术讨论指出,工具返回的日志、认证、序列化和重试代码往往远多于真正影响决策的信息。与其把全部结果塞入上下文,不如先根据当前问题筛选出关键片段,以降低上下文污染和推理成本。

• 上下文越长不一定越好:DeepSeek V4.1 Flash 在超过 100K 至 200K 上下文后速度下降的反馈,说明长上下文会带来延迟和吞吐成本。Agent 工作流应考虑摘要、分段读取、按需检索和任务状态持久化。

— message 1 of 2 —