📡 Linux.do 频道日报 · 午报
有效消息 323 条
📡 Linux.do 频道日报 · 2026-08-17
单一频道综合 · 已去重整理
一、今日要闻
1. DeepSeek 涨价落地,低价 Agent 工作流集中失效
• 多位用户称 DeepSeek V4 Flash、V4 Pro 的实际成本明显上升,原先可日跑数千万至数亿 Token 的使用习惯被迫收缩;个案称涨价后半小时已消耗约 15 元。
• OpenCode Go 被指同步调整:其套餐总额度及 DeepSeek V4 Flash 可用量均被大幅压缩,部分用户称 Flash 额度缩水逾 8 倍,原本宣传的“2 倍可用度”描述也被移除。
• 用户反馈已出现缓存异常、输出胡言乱语、Harness 报
影响:以低单价长时间跑 Agent 为核心的个人开发工作流,正从“优先堆 Token”转向限额管理、模型分层与替代渠道比价。
2. OpenCode Go “15 美元额度”规则引发澄清与退款争议
• 有用户解释,特定模型并非在 60 美元套餐之外额外获得 15 美元,而是套餐中这类模型总计仅能使用 15 美元对应的 ZDR API 用量;按正价折算,价格约为 6.6 折,并受周限与 5 小时限制。
• 此解释与不少用户此前对“多个模型分别拥有 15 美元额度”的理解不同,导致大量订阅者重新评估套餐价值。
• 有人称开通 Go 十余天已使用约 70% 额度,涨价后申请退款但邮件未获回复;另有用户反映 Krill 退款会追扣历史活动赠金,实际到账远低于站内余额。
影响:订阅方案的标称额度不足以反映真实价值,模型可用额度、倍率、峰谷规则、退款口径和服务承诺必须在充值前单独核验。
3. Codex 向 ChatGPT 订阅账号开放 GPT-5.6 Sol 百万上下文
• OpenAI Codex 团队成员 Tibo 宣布,GPT-5.6 Sol 的 100 万 Token 上下文能力不再仅限 API Key,也可通过 ChatGPT 账号使用。
• 频道内已分享 CLI 配置思路,包括
• 同日也出现无法生效的反馈:中转渠道配置后仍显示约 258K 上下文,GPT Free 账号提示不支持
影响:超长代码库、长任务资料和多轮 Agent 协作有了更大容纳空间,但不同账号、客户端和中转层的支持并不一致。
4. 百万上下文并非无代价,效果与计费仍待实测
• 社区观点分化:一方认为 1M 可减少压缩丢失,适合超长任务;另一方认为过长上下文会带来注意力稀释,可能不如 256K 配合摘要压缩稳定。
• 有经验帖建议不要默认全程开启 1M,理由是长窗口可能消耗更多额度,并会使低相关历史内容干扰任务执行;官方人员关于订阅场景是否额外计费的表述也被认为尚未完全统一。
• 为节省 Codex 额度,有用户尝试减少异步任务的空轮询,将等待时间设为 180 至 300 秒,实测节省约 5% 至 10%,低于“节省 25%”的流传说法。
影响:上下文窗口应按任务开启,长上下文、自动压缩、轮询频率和模型调用成本将成为新的工程调优项。
5. 中转站与“公益站”信任危机持续发酵
• 多名用户围绕某公益站注册码、订阅与“监控站大爷”事件发帖,指称服务不可用、主帖删除、退款困难及收费规则多次变化;涉及“股东权益”“VIP 渠道”“订阅制”等历史宣传的描述仍属用户单方陈述。
• 另有用户称购买 API 邀请码或 LDC 服务后频繁报错、难以退款;也有人提出,LDC 虽非现金但具社区通用价值,收取 LDC 本质仍是交易,应按风险和对等性判断。
• 频道中同时存在多条中转推广,但这类广告性内容未纳入推荐结论。
影响:无法稳定交付、缺少售后凭据的平台,对开发连续性和预充值资金均构成风险;“公益”标签不能替代服务质量与交易保障。
6. AI 编程工具链兼容性问题密集出现
• Codex Mac 客户端有两类截然不同反馈:部分用户称新版本 CPU、内存占用下降,80 轮、约 100MB 的会话可秒开;另一些用户则称切换应用或打开窗口仍严重卡顿。
• ChatGPT 新增的 Computer History 被发现可能通过 macOS 无障碍接口拖慢 IntelliJ IDEA,尤其在 Git 历史较多时更明显;可关闭该功能、将 IDEA 排除,或在 IDEA VM Options 增加
• CC Switch 在微软商店版 Claude Desktop 上无法切换模型,被怀疑与 MSIX 后配置目录从
影响:模型能力提升未自动转化为生产力,桌面端资源占用、网络路径、配置目录和工具链版本仍是实际工作流中的高频阻塞点。
7. 国产模型替代方案进入重新比较期
• 在 DeepSeek 成本上升后,用户集中比较 Kimi K2.7 Code、GLM 5.2/5.3、Kimi K3、火山 Flash、Ollama Pro 与各类 Coding Plan;有人从 OpenCode Go 转向月之暗面,也有人认为 K3 的 199 元月包难以覆盖项目级编程。
• 多 Agent 编排的实操观点认为,主控模型更看重全局视角、连续推理和指令遵循:GLM 5.2/5.3、较高阶 Claude 与 GPT 被评价为较适合作任务拆解和验证,Worker 则可优先考虑速度与基础编码准确率。
• 关于 Gemini 3.7 Flash 前端能力、DeepSeek V4 Pro 与 GLM 5.3/GPT-Luna 对比、国内模型 API 与 Coding Plan 的取舍,仍停留在用户体验交流,暂无统一测评标准。
影响:模型选型正从单一“便宜量大”转向主控、执行、审查分层,且需把稳定性、延迟和供应商风险纳入成本。
8. 硬件、产业与消费者议题同步升温
• 据转帖,谷歌或已委托 AMD 参与第十代 TPU 设计,传闻方向是将 AMD 先进封装与 CPU IP 用于包含 CPU 核、面向强化学习负载的混合型 AI ASIC;该消息源自 SemiAnalysis 报告,尚待官方确认。
• 法拉第未来宣布探索机器人业务独立融资及上市,提出年底前销售出货 2,000 台 EAI 本体,并推进英伟达技术栈、GR00T 训练与 SONIC 真机控制。
• 中消协此前报告指出 AI 客服相关投诉显著增加,问题包括人工客服难接通、循环应答阻碍转人工,以及经营者以“AI 回答不代表公司立场”为由拒绝履约。
影响:AI 的产业投入仍在加速,但面向消费者的可追责性、人工兜底和服务承诺边界正成为监管与产品设计的共同问题。
二、分主题深读
🤖 AI 与算力
• DeepSeek Harness 热度与疑问并存:用户关注其“一切皆插件”的设计究竟适合哪些场景,也讨论更换到非 DeepSeek 模型后是否还有保留 Harness 的必要。已有反馈称其会报未知工具错误;对 DSH 是否能显著提升 Agent 能力尚无一致结论。
• 长上下文实践:Codex 可通过 CLI、模型目录或 Agent 配置启用 Sol 1M;子代理方面,有人给出创建
• 本地部署:DGX Spark 上部署 Qwen3.8-27B 的实践采用 NVFP4、投机解码和 262,144 上下文;另有用户计划在 4 张 A10 上部署同系列模型,探索个人网站讲解员、轻量编程与角色扮演等用途。
— message 1 of 2 —
有效消息 323 条
📡 Linux.do 频道日报 · 2026-08-17
单一频道综合 · 已去重整理
今日一句话:频道讨论几乎被 AI 编程成本重估主导:DeepSeek 涨价与 OpenCode Go 缩量触发迁移潮,Codex 释放 GPT-5.6 Sol 百万上下文则带来新的能力期待与资费、效果争议;与此同时,公益站与中转服务的稳定性、退款和交易边界成为另一条高频风险线。
一、今日要闻
1. DeepSeek 涨价落地,低价 Agent 工作流集中失效
• 多位用户称 DeepSeek V4 Flash、V4 Pro 的实际成本明显上升,原先可日跑数千万至数亿 Token 的使用习惯被迫收缩;个案称涨价后半小时已消耗约 15 元。
• OpenCode Go 被指同步调整:其套餐总额度及 DeepSeek V4 Flash 可用量均被大幅压缩,部分用户称 Flash 额度缩水逾 8 倍,原本宣传的“2 倍可用度”描述也被移除。
• 用户反馈已出现缓存异常、输出胡言乱语、Harness 报
Error: unknown tool "" 等问题,但尚不能确认是模型、渠道、缓存计费还是客户端故障。影响:以低单价长时间跑 Agent 为核心的个人开发工作流,正从“优先堆 Token”转向限额管理、模型分层与替代渠道比价。
2. OpenCode Go “15 美元额度”规则引发澄清与退款争议
• 有用户解释,特定模型并非在 60 美元套餐之外额外获得 15 美元,而是套餐中这类模型总计仅能使用 15 美元对应的 ZDR API 用量;按正价折算,价格约为 6.6 折,并受周限与 5 小时限制。
• 此解释与不少用户此前对“多个模型分别拥有 15 美元额度”的理解不同,导致大量订阅者重新评估套餐价值。
• 有人称开通 Go 十余天已使用约 70% 额度,涨价后申请退款但邮件未获回复;另有用户反映 Krill 退款会追扣历史活动赠金,实际到账远低于站内余额。
影响:订阅方案的标称额度不足以反映真实价值,模型可用额度、倍率、峰谷规则、退款口径和服务承诺必须在充值前单独核验。
3. Codex 向 ChatGPT 订阅账号开放 GPT-5.6 Sol 百万上下文
• OpenAI Codex 团队成员 Tibo 宣布,GPT-5.6 Sol 的 100 万 Token 上下文能力不再仅限 API Key,也可通过 ChatGPT 账号使用。
• 频道内已分享 CLI 配置思路,包括
model_context_window 1000000 与 model_auto_compact_token_limit 900000;亦有通过自定义模型目录、配置文件让 Codex App 使用 1M 窗口的实践。• 同日也出现无法生效的反馈:中转渠道配置后仍显示约 258K 上下文,GPT Free 账号提示不支持
gpt-5.6-sol。影响:超长代码库、长任务资料和多轮 Agent 协作有了更大容纳空间,但不同账号、客户端和中转层的支持并不一致。
4. 百万上下文并非无代价,效果与计费仍待实测
• 社区观点分化:一方认为 1M 可减少压缩丢失,适合超长任务;另一方认为过长上下文会带来注意力稀释,可能不如 256K 配合摘要压缩稳定。
• 有经验帖建议不要默认全程开启 1M,理由是长窗口可能消耗更多额度,并会使低相关历史内容干扰任务执行;官方人员关于订阅场景是否额外计费的表述也被认为尚未完全统一。
• 为节省 Codex 额度,有用户尝试减少异步任务的空轮询,将等待时间设为 180 至 300 秒,实测节省约 5% 至 10%,低于“节省 25%”的流传说法。
影响:上下文窗口应按任务开启,长上下文、自动压缩、轮询频率和模型调用成本将成为新的工程调优项。
5. 中转站与“公益站”信任危机持续发酵
• 多名用户围绕某公益站注册码、订阅与“监控站大爷”事件发帖,指称服务不可用、主帖删除、退款困难及收费规则多次变化;涉及“股东权益”“VIP 渠道”“订阅制”等历史宣传的描述仍属用户单方陈述。
• 另有用户称购买 API 邀请码或 LDC 服务后频繁报错、难以退款;也有人提出,LDC 虽非现金但具社区通用价值,收取 LDC 本质仍是交易,应按风险和对等性判断。
• 频道中同时存在多条中转推广,但这类广告性内容未纳入推荐结论。
影响:无法稳定交付、缺少售后凭据的平台,对开发连续性和预充值资金均构成风险;“公益”标签不能替代服务质量与交易保障。
6. AI 编程工具链兼容性问题密集出现
• Codex Mac 客户端有两类截然不同反馈:部分用户称新版本 CPU、内存占用下降,80 轮、约 100MB 的会话可秒开;另一些用户则称切换应用或打开窗口仍严重卡顿。
• ChatGPT 新增的 Computer History 被发现可能通过 macOS 无障碍接口拖慢 IntelliJ IDEA,尤其在 Git 历史较多时更明显;可关闭该功能、将 IDEA 排除,或在 IDEA VM Options 增加
-Dsun.awt.mac.a11y.enabled=false。• CC Switch 在微软商店版 Claude Desktop 上无法切换模型,被怀疑与 MSIX 后配置目录从
%LOCALAPPDATA%\Claude-3p\ 迁移有关;Sub2API 接 Codex 的 502/504、Antigravity 更新后代理失效等问题也在求解中。影响:模型能力提升未自动转化为生产力,桌面端资源占用、网络路径、配置目录和工具链版本仍是实际工作流中的高频阻塞点。
7. 国产模型替代方案进入重新比较期
• 在 DeepSeek 成本上升后,用户集中比较 Kimi K2.7 Code、GLM 5.2/5.3、Kimi K3、火山 Flash、Ollama Pro 与各类 Coding Plan;有人从 OpenCode Go 转向月之暗面,也有人认为 K3 的 199 元月包难以覆盖项目级编程。
• 多 Agent 编排的实操观点认为,主控模型更看重全局视角、连续推理和指令遵循:GLM 5.2/5.3、较高阶 Claude 与 GPT 被评价为较适合作任务拆解和验证,Worker 则可优先考虑速度与基础编码准确率。
• 关于 Gemini 3.7 Flash 前端能力、DeepSeek V4 Pro 与 GLM 5.3/GPT-Luna 对比、国内模型 API 与 Coding Plan 的取舍,仍停留在用户体验交流,暂无统一测评标准。
影响:模型选型正从单一“便宜量大”转向主控、执行、审查分层,且需把稳定性、延迟和供应商风险纳入成本。
8. 硬件、产业与消费者议题同步升温
• 据转帖,谷歌或已委托 AMD 参与第十代 TPU 设计,传闻方向是将 AMD 先进封装与 CPU IP 用于包含 CPU 核、面向强化学习负载的混合型 AI ASIC;该消息源自 SemiAnalysis 报告,尚待官方确认。
• 法拉第未来宣布探索机器人业务独立融资及上市,提出年底前销售出货 2,000 台 EAI 本体,并推进英伟达技术栈、GR00T 训练与 SONIC 真机控制。
• 中消协此前报告指出 AI 客服相关投诉显著增加,问题包括人工客服难接通、循环应答阻碍转人工,以及经营者以“AI 回答不代表公司立场”为由拒绝履约。
影响:AI 的产业投入仍在加速,但面向消费者的可追责性、人工兜底和服务承诺边界正成为监管与产品设计的共同问题。
二、分主题深读
🤖 AI 与算力
• DeepSeek Harness 热度与疑问并存:用户关注其“一切皆插件”的设计究竟适合哪些场景,也讨论更换到非 DeepSeek 模型后是否还有保留 Harness 的必要。已有反馈称其会报未知工具错误;对 DSH 是否能显著提升 Agent 能力尚无一致结论。
• 长上下文实践:Codex 可通过 CLI、模型目录或 Agent 配置启用 Sol 1M;子代理方面,有人给出创建
gpt-5.6-luna 专用 Worker 的方法,定位为边界清晰、可独立完成的委派任务,不应改变主任务目标。• 本地部署:DGX Spark 上部署 Qwen3.8-27B 的实践采用 NVFP4、投机解码和 262,144 上下文;另有用户计划在 4 张 A10 上部署同系列模型,探索个人网站讲解员、轻量编程与角色扮演等用途。
— message 1 of 2 —