📡 Linux.do 频道日报 · 早报
有效消息 157 条

📡 Linux.do 频道日报 · 2026-08-20
多源综合 · 仅整理 Linux.do 频道内容 · 已去重归纳

今日主线:频道讨论高度集中在 AI 编程工具、模型套餐与中转服务的额度变化,OpenCode、Codex、DeepSeek、Grok、Gemini 等产品频繁出现调整、降速、限流与价格争议。与此同时,本地模型部署、Agent 工具链、云服务器风控和账号安全仍是技术讨论的另一条主线。


一、今日要闻

1. OpenCode 围绕模型供给连续调整,免费与低价生态波动明显
• 多条消息显示,OpenCode Go 先后出现 Muse Spark 下架、恢复,以及将部分模型替换为 Hy3 的情况;与此同时,Hy3 获得限时大幅用量,部分讨论称其额度提升至原来的 8 倍。
• 频道用户认为,Hy3 在部分编程场景的能力和速度未必能完全替代 Muse Spark 或此前的 DeepSeek Flash,套餐的实际价值仍取决于模型质量、响应速度和可用时段。
• 有用户反馈,OpenCode 近期额度减少、模型能力下降,开始考虑 CommandCode、OllamaPro 等替代方案。
补充:免费模型、倍率和套餐内容变动很快,单看宣传额度不足以判断性价比。

2. Codex、GPT 与 Claude 服务出现速度、额度和支付异常
• 有用户反映 GPT 5.6 Sol 在前一日下午开始明显卡顿,速度约降至此前的三分之一,但切换到 Terra 后恢复正常;另有用户称 GPT 在北京时间 23 点左右经常变得迟缓或不可用。
• GPT Team 用户频繁遇到“所选模型达到容量上限”的提示,部分人认为服务已经影响正常使用;网页版用户还观察到 Sol 不同推理档位的 Juice 数值发生变化。
• Codex 用户关注 5 小时限制是否回归,控制面板中出现“GPT 5.3 Codex Spark 5h”的迹象,但目前只能视为用户侧观察,尚不能确认是全面政策。
• Plus 升级 Pro、试用资格、Google Pay 付款和地区税费也出现多起问题,包括升级时拒卡、试用流程卡住以及不同地区最终扣款金额接近等情况。
补充:这些现象可能同时受到区域、账号状态、负载、支付渠道和风控策略影响,不能仅凭单个账号判断全局。

3. DeepSeek V4 Flash 及相关套餐成为高用量用户的新成本压力
• 多名用户表示 DeepSeek 涨价后,V4 Flash 或 V4 Pro 的官方 API 和中转价格难以承受,甚至出现每天约 10B tokens用量寻找低价渠道的需求。
• 一份 OllamaPro 体验记录称,DeepSeek V4 Flash 开启 Max 思考时,最长输出约为 65K tokens;复杂任务可能尚未完成推理就触及上限。
• 同一记录估算,一下午约消耗 132M tokens,约占每周额度的 10%。其优势在于本地套餐不依赖中转缓存命中,但智力表现和复杂问题完成度仍待更多实测。
• 频道还出现 DeepSeek Harness 更新以及支持调用 Codex、Claude Code、多模态能力等讨论,用户正在研究其 Agent 编排和扩展方向。
补充:不同套餐的 token 统计口径、缓存规则和思考输出限制可能不同,数字应以实际账单和后台为准。

4. 国产模型 coding plan 进入横向比较阶段
• 用户正在比较火山 Coding Plan、OpenCode Go、阿里云 Token Plan 等服务,希望一次性测试多个国产模型,而不是分别购买 API 或订阅。
• Composio 对 DeepSeek V4 Pro 在不同 harness 下的表现进行对比,有讨论认为 Pi 偏向能力表现,DeepSeek Harness 更省成本,但具体结论仍依赖任务类型和调用方式。
• DeepSeek Harness 的源码学习帖则从注册、配置、路由、声明式调用和 fallback 等角度分析 Agent 架构,并讨论当前 AI 应用生态偏向 TypeScript 的现状。
• 部分用户遇到 dsh 中无法正确设置推理等级、思考过程偏离原问题、并行任务互相串线等问题,说明工具链的可控性和上下文管理仍不稳定。

5. 新模型与平台更新密集出现,但性能评价分歧较大
• Ornith-1.5 系列开源发布 397B MoE、35B MoE 和 9B三个版本,官方称其性能对标高端闭源模型;频道转发了其 Coding、Terminal 和 SWE-bench 等基准数据,但实际体验尚需社区复测。
• Gemini 用户反馈近期文档处理速度较快,Spark 的网络搜索在冷门信息检索方面有所改善;另有用户展示 Gemini 生成 SVG 动画的案例。
• Grok Free 出现 503错误,Grok 4.6 也被用户评价为“明显降智”,主要表现为思考减少、上下文遗忘和快速输出。
• Cursor 宣布或据称将在 8 月 24 日调整 Auto 用量,具体幅度尚未明确;社区同时猜测 Composer 3 可能在相近时间发布。
• Replit 免费模式被曝支持 5.6 Luna,腾讯 IAM Copilot 出现免费使用 GLM 5.3 的界面,OpenRouter 渠道的免费 GLM 5.2 上下文据称从 128K 提升至 256K。
补充:模型名称、版本号和宣传基准较多,真实可用性仍应结合长上下文、工具调用、代码修复和稳定性验证。

6. 本地部署从“能跑”走向“可用”,显卡与华为服务器成为重点
• 有用户使用魔改 RTX 3080 20G运行 Qwen 3.8 27B,100K 上下文场景约达到 50 tokens/s;首轮代码效果较差,经过两轮修改后基本可用。
• 另一项讨论认为,Qwen 3.8 27B 在 Mac M5 Max 128G上以约 15 tokens/s运行,尽管设备价格较高,但对本地代码工作流具有吸引力。
• 有企业用户计划在华为 910C上部署 Qwen 3.8 27B 和 Qwen-Image,并准备整理部署踩坑经验。
• Intel Arc A770 16G 用户分享了本地 AI 推理和 ComfyUI 加速实践,社区对 Intel 显卡生态的关注点集中在驱动、算子支持和自制推理引擎。
补充:本地推理速度受量化方式、上下文长度、批处理和算子实现影响,不能直接横向比较。

7. AI Agent 的权限边界和密钥安全再次敲响警钟
• 一名用户让 Codex 与 Claude 协助处理加密货币相关操作,在“替用户批准”模式下,模型因价格波动提前赎回部分产品,最终仅成交一笔。
• 另一名中转站运营者称上游 key 泄露后被反复盗刷,累计损失达到数千至数万元,原因包括上游较多、工作繁忙以及未及时配置 IP 白名单。
• 频道讨论认为,涉及资金、生产环境、服务器删除和批量外部请求时,模型不应拥有无条件执行权限;API key 应实施最小权限、来源限制、额度上限和异常告警。
补充:任何自动化 Agent 都应将“读取、拟议、确认、执行”分层,涉及不可逆操作时必须保留人工确认。

8. 云服务、通信账号和平台风控问题持续出现
• Google Cloud 用户称仅使用网络质量检测工具就收到多次风控邮件,被判断为疑似 DoS;社区提醒测试工具的请求模式可能触发云厂商安全策略。
• Oracle Cloud 有用户反馈,即使提前将实例降配至较低配置,仍出现批量停机,约 30 个账号中有 12 台受到影响;另有用户担心升级账号运行 4H24G 实例产生意外账单。
• CTExcel 用户收到激活后需在 7 日内订购套餐的短信或邮件,并据此质疑“低成本长期保号”的说法;Giffgaff 则有账号恢复并获赠 10 英镑的个案。
• Telegram 在部分 ColorOS 15、realme 6.0 设备上出现反复闪退,Telegram X 暂未出现同样问题;Edge 用户则遇到动画和动态头像无法显示,代理开启时还可能出现证书隐私错误。

二、分主题深读

🤖 AI 编程与 Agent 工具链

• 并行 Agent 带来认知负荷:用户分享长期并行多个 Codex 会话后,长文本阅读能力下降。其观察是,人脑仍以串行为主,频繁切换不同会话相当于不断重建上下文,容易造成注意力消耗。对实际工作而言,减少无效并行、统一任务记录和分批审阅结果,可能比同时开启更多 Agent 更有效。

— message 1 of 2 —