📡 Linux.do 频道日报 · 早报
有效消息 163 条

📡 Linux.do 频道日报 · 2026-08-23
多源综合 · 已去重整理

今日主线:AI 服务的价格、路由与可用性继续成为频道讨论核心,DeepSeek 周末低谷价正式落地,GPT、Claude、Codex 等产品则集中出现模型降级、风控、封号与额度异常反馈。与此同时,Agent 工作流、模型横评、本地部署和低成本基础设施仍在快速演进。


一、今日要闻

1. DeepSeek API 周末全天按低谷价格计费
• DeepSeek 官方通知称,自北京时间 8 月 23 日 00:00 起,工作日继续执行峰谷分段计费,周六、周日全天统一按照低谷时段价格收取调用费用。
• 工作日高峰时段仍为北京时间 9:00—12:00、14:00—18:00,其余时间为低谷时段;频道内的戏称是工作日高峰才叫“梁文峰”,周末全天都是“梁文谷”。
• 官方称调整既方便用户在周末安排业务,也有助于平衡全网算力负载。调整生效前产生的费用仍按原规则结算,继续使用则视为接受新计费方式。
• 影响:周末批量推理、代码生成、离线任务和自动化工作流的调用成本下降,但工作日核心办公时段价格未变。

2. DeepSeek V4 Flash Vision Exp 的图像计费规则受到关注
• 频道补充信息显示,发送给 deepseek-v4-flash-vision-exp 的图片会按照图片尺寸换算为 token,并与文本 token 一并计费。
• 这意味着图像批处理、发票识别、商品图分析等场景,不能只按文字输入量估算成本,需要同时考虑图片分辨率、数量和上下文长度。
• 有用户询问硅基流动上的 DS-v4-flash-0731 是否恢复涨价前价格,以及是否经过量化、是否有外审和量化信息;目前频道没有形成确定结论。
• 判断模型渠道时,价格恢复并不等于模型版本、权重精度和服务质量完全一致,仍需自行进行能力、延迟和输出稳定性测试。

3. GPT、Codex 路由降级与额度异常持续发酵
• 多名用户反馈 ChatGPT 或相关中转服务疑似被路由到 5.5 mini,即使使用正价订阅、切换网络、浏览器指纹、设备和节点,仍未必恢复高阶模型。
• 也有用户称,退出账号后通过无痕模式能够获得更高版本回复,因而怀疑模型路由与账号、IP、设备或风控状态存在关联;这些均属于个体测试,尚不能视为官方规则。
• 频道还出现 GPT-5.6、GPT-5.6-SOL 在复杂任务中回答质量下降、思考时间较长但结果错误、回复反复总结和输出大量无效解释等反馈。
• 风险:订阅价格、模型名称和实际调用模型可能并不完全对应,长任务应保留可复现测试,并监控模型名称、token、缓存命中率和错误率。

4. Codex CLI 发布 0.149.0,桌面端沙箱机制成为实用问题
• Codex CLI 发布 v0.149.0,同时频道内出现多篇关于 Codex 使用体验、桌面端 coding、Windows 工具调用和逆向分析风控的讨论。
• Windows Elevated Sandbox 会创建独立的普通用户,例如 CodexSandboxOffline 和 CodexSandboxOnline,命令并非直接以当前登录用户执行。
• 因此,使用 WinGet 以当前用户范围安装的 uv、ffmpeg 等工具,可能因沙箱用户的路径和 ACL 权限无法执行;讨论建议优先考虑 Machine Scope 安装及明确配置 PATH、权限和网络规则。
• 另有用户因让 Codex 分析 IPA、修改网页 JavaScript 逻辑而收到 OpenAI 的 cyber abuse 警告,后续又经历申诉通过、封禁邮件和警告邮件顺序异常的情况。
• 涉及逆向、抓包、二进制分析或绕过访问控制时,应确认资产所有权和授权边界,避免把可疑操作直接交给在线模型执行。

5. 模型降智、服务端限档与中转质量成为集中投诉点
• 频道用户称,部分中转站的模型回答速度很快,但能力明显下降;使用“糖果问题”“鹈鹕自行车”等测试时,结果与检测网站排名不一致,因而质疑部分模型检测站和中转渠道之间存在利益关系。
• Fable 的 high、xhigh 思考等级被指疑似服务端下调,社区测试称 high 只有原先 low 档位水平,xhigh 也受到限制;目前仍属于用户观察,未获官方确认。
• OpenCode Go 通过 CC Switch 路由到 Claude Code 时,部分模型缓存命中率明显低于 DeepSeek 官方 API;Sonnet 相对稳定,Opus、Fable 和部分 Ox Alpha 路由则出现只命中少量 token 的情况。
• 建议:不要只看站内“实时检测”或倍率,实际采购前应测试长上下文、工具调用、代码修改、拒答边界、缓存和多轮一致性。

6. 新模型与神秘模型集中出现,评测热度上升
• OpenRouter 出现限时免费的 stealth/ox-alpha,频道称其免费使用可能持续至 8 月 28 日,部分测试中表现超过 Fable 5,也可通过 OpenCode Zen 接入。
• Arena 中疑似出现 HY3-Preview 新变体,有用户猜测可能是 HY4 checkpoint;初步反馈认为其 3D 建模能力明显强于 HY3。
• HY3 相关讨论中还出现以“I'm doing”开头的异常回复,社区猜测可能与灰度模型、思维链总结或路由变化有关,尚无可靠证据。
• 频道用户对 Qwen3.8-27B 未审查版本、本地模型量化、GLM 5.3、DeepSeek V4 Flash Vision Exp 等进行实际任务测试,结果显示不同模型在代码、审查、视觉和 Agent 任务上的差异远大于简单榜单排名。

7. Agent 工作流从提示词工具转向长期运行时
• 有频道成员将 Agent 演进归纳为五个阶段:第一代 Prompt Platform,第二代以工作流和 RAG 为核心的 Agent Builder,第三代整合工具、Skill、MCP 与 Memory 的 Agent Platform,第四代面向 24 小时长任务的 Agent Runtime,后续则可能进一步走向多 Agent 协同和自治系统。
• 实践层面,用户尝试用 Codex、Claude Code 等模型负责目标拆解和实施计划,再交给 DSH 极简模式的 /goal 执行,以兼顾规划能力、执行速度和多轮操作。
• 也有用户在 DSH 中出现子代理递归调用,单个任务累计启动 36 个 subagent,造成 token 消耗迅速上升;另有远程任务中 260K 输入 token 的成本测算显示,Luna 相比 Sol 可能节省约 65.5%—72.4% 的输入费用。
• 核心问题已从“哪个模型最强”转向“如何限制代理范围、控制递归、管理上下文、验收中间产物并控制成本”。

8. AI 订阅与公益中转的稳定性明显下降
• 频道内关于 Claude 订阅、拼车和羊毛的帖子减少,部分用户认为订阅成本、封号风险和可获得优惠下降,使 Claude 相关讨论热度不如过去。
• 云雾中转疑似出现用户被禁用、模型广场消失和 API 返回 403 的情况;VIRCS 则发布了官方通知,用户反馈更换公司后工单响应速度有所改善。
• OpenCode 中的 mimo-v2.5-free 出现所有凭证冷却、429 rate_limit 报错;ZCode 送出的免费额度也被认为可能已结束,新注册用户不再获得此前的一亿 token。
• 低倍率、免费额度和公益站都存在随时变化的可能,余额不宜长期沉淀,关键项目应准备备用渠道。

9. AI 编程正在进入“多模型协作”阶段
• 多名用户讨论 Codex、Claude Code、Cline、Pi Agent、DSH、OpenCode 等工具的混用方式,不再把单一模型或单一编辑器视为固定最优解。
• 一种较受认可的工作流是:用推理能力较强的模型完成需求分析、任务拆解和验收标准,再用价格更低、执行速度更快的模型完成具体修改,最后由独立模型复核。
— message 1 of 3 —