📡 Linux.do 频道日报 · 晚报
有效消息 371 条
📡 Linux.do 频道日报 · 2026-08-17
单一频道综合 · 已去重整理
一、今日要闻
1. DeepSeek 调价成为全站主线,实际使用成本被反馈上升数倍
• 多位用户称,DeepSeek V4 Pro、V4 Flash 及依赖其上游的聚合服务在 8 月 17 日出现显著价格变化,原有“量大管饱”的使用逻辑被打破。
• 个案中,有用户续跑任务时,约 1 亿 Token 消耗 35 元;也有人报告同等项目的实际支出约为此前 5 倍,或称 Flash 用量成本上升约 2.5 倍。
• 社区讨论认为,峰谷计费、缓存命中率和中转商二次调价共同放大了体感差异;不能仅用标价判断真实成本。
• 影响:高频 coding、长上下文 Agent、文职批处理用户首当其冲,低价 API 生态正经历一次快速洗牌。
2. DeepSeek 上游变化向中转站和订阅产品传导,多个渠道被质疑缩水或涨价
• OpenCode Go、Command Code、部分自建或“自部署”名义服务被用户指出同步调整价格、额度或倍率,原先依靠低价 DeepSeek 建立的套餐优势明显减弱。
• 有用户称某 Pro 套餐在 5 小时窗口内仅完成约 5 个问题便耗尽额度,统计显示约 1300 万 Token,对计量合理性提出质疑。
• 另有用户反馈低价 DeepSeek 渠道出现高错误率、首 Token 响应慢、历史会话中断及客服响应不足等问题。
• 共识:低价不再等于低成本;稳定性、缓存策略、模型真实性和失败重试成本,正在成为选择渠道的核心指标。
3. Codex 生态出现 1M 上下文设置争议、额度重置收费及账号验证问题
• 多名用户尝试按 OpenAI Codex 负责人 Thibault Sottiaux 的公开提示,将上下文窗口从 200K改为 1M,但客户端实测仍会较早压缩,或从服务端缓存文件读取到约 372K / 832K上下文。
• API 模式默认上下文据称已提高到 1M,但不同客户端、订阅层级和服务端配置显示并不一致,部分用户未看到预期标识。
• 社区还出现 Codex 周限用尽后弹出付费重置的案例:据截图,Plus 用户可支付 8 美元重置至 100% 额度。
• 待确认:1M 是全量开放、灰度资格还是仅部分 API 路径生效;用户应以实际模型缓存、压缩节点和账单数据为准。
4. OpenAI Codex 被曝未来或接入 Astra,编程与安全能力值得跟踪
• 社区转引称,Codex 负责人确认未来将接入 Astra;该模型名称已公开但尚未正式发布,暂无明确上线日期与开放范围。
• 转述信息称,Astra 在 Agent 编程及网络安全内部评估中表现突出,OpenAI 曾因安全能力评估而暂停部分不符合新标准的内部活动。
• 影响:若消息属实,Codex 的模型层能力可能继续上探;同时,能执行复杂任务的 Agent 将面对更严格的安全边界与访问控制。
5. GPT、Claude、Grok 多线出现“更贵、更严或更不稳定”的用户反馈
• GPT Plus、Team 与 Pro 用户集中讨论周额度下降、消耗加快、手机号验证、将订阅放入中转后被封等问题;部分 Team 用户称周额度降至约 20 美元。
• Claude 侧,用户关注原有额外 50%周额度是否会在数日后到期,也讨论官网账号风控、Max 订阅是否值得升级及 Kiro 等替代接入。
• Grok 侧出现免费账号被标记、X 账号因互动频繁受限、Heavy 年付折扣转换规则复杂等反馈。
• 共识:账号池、共享分发、跨区支付与自动化高频调用的风险上升,官方订阅的稳定性也不再是绝对保证。
6. Qoder、智谱与多模型编程工具体验分化,Token 计量透明度被追问
• 用户称 Qoder 改版后套餐“更不耐用”,按其估算,原先约 150 Credits / 1M Token的消耗,现可能变为约 100 Credits / 1M Token;另有用户反馈 Qoder CN 响应慢且频繁提示网络繁忙。
• 智谱 Max 套餐也被质疑五小时额度消耗异常快;有用户记录约 343 次调用后即触及限制。
• 关于模型效果,社区测试显示 Qwen3.8-27B 在特定 SVG“黑洞”任务中表现超出预期,而部分 GPT-5.6 Sol 聚合线路在相同任务上疑似存在效果或速度波动。
• 影响:模型能力、路由渠道、思考强度、缓存与工具调用中断相互耦合,单纯以模型名比较已不够可靠。
7. Stripe 据报道以逾 70 亿美元收购 OpenRouter,AI 模型路由价值被资本重估
• 频道转引彭博消息称,支付公司 Stripe已完成对 AI 模型网关初创公司 OpenRouter的收购,交易金额超过 70 亿美元。
• OpenRouter 的核心能力是帮助客户按任务、预算和模型特性选择不同模型;其今年 5 月曾宣布完成 1.13 亿美元B 轮融资,估值约 13 亿美元。
• 为何重要:在模型价格波动、供应商频繁调整的背景下,统一接入、智能路由、账单治理和容灾能力正从“开发者便利功能”变为基础设施价值。
8. AI 语音与自动化工具继续落地,Qwen-Audio-3.0 上线
• 阿里云宣布 Qwen-Audio-3.0系列上线千问 AI 平台及阿里云百炼,覆盖 ASR 语音识别、TTS 语音合成和实时语音对话。
• 频道转引信息称,该系列在 Artificial Analysis 今年 7 月榜单中位列语音识别、实时交互、语音合成三个赛道第一。
• 同日,豆包输入法 Windows 内测版加入小鹤、自然码双拼;“工作任务”模式则新增手机远程操作电脑能力。
• 影响:语音输入、实时助手与桌面自动化开始形成可组合工作流,开发者更关心准确率、时延和私有数据边界。
二、分主题深读
🤖 AI 与算力
• 峰谷计费改变使用行为:DeepSeek 调价后,用户开始讨论是否应让公益站、中转站采用更动态的价格机制,以在高峰期抑制拥堵、在低谷期吸引批处理流量。反对意见隐含在用户体验中:价格过于频繁变化会增加预算不确定性。
• 缓存命中率成为账单关键变量:针对“简单问题烧掉十余元”的争议,有用户按账单拆解称,数百万输入 Token 中,未命中缓存部分若按高峰价格结算,可占绝大多数费用。长会话不是天然省钱,复用上下文与缓存策略更重要。
• 模型替代需求激增:社区频繁比较 DeepSeek、Kimi K3、GLM、Qwen、Luna、Terra、Sol、Claude Fable 等,希望为翻译、总结、上下文压缩、小型代码修改和重型 Agent 分别寻找更合适的模型。
• 本地部署仍有现实门槛:有用户咨询 RTX 5080 16GB 用于 AI 视频、本地模型与 YOLO 后的进阶方案;另有公司采购方案在 RTX 4060 16GB 与 RTX 4090 24GB、64GB 内存之间权衡开发、爬取和本地推理需求。显存仍是本地 AI 工作流的硬约束。
• AI 视频与换脸需求强调隐私:业务方称云端换脸按秒计费过高,且因涉及用户隐私不适合普通中转。讨论指向私有部署、专有云和数据最小化,而非仅追求模型效果。
🧑💻 编程工具与开发实践
• Vibe Coding 从“让 AI 写代码”转向流程治理:用户分享实践为先以 Plan 模式明确需求和约束,再以高思考强度执行,最终人工测试与 Review。讨论重点已不只是 Prompt,而是如何减少返工、管理上下文和验证交付结果。
• OpenCode V2 被视为破坏性升级:体验者指出,V2 的 Plugin API 与 V1 不兼容,许多依赖动态上下文裁剪等能力的插件尚未迁移;但部分 PTY 类插件功能已被新版 Shell 原生支持。升级前需评估插件链路,而非直接覆盖安装。
— message 1 of 3 —
有效消息 371 条
📡 Linux.do 频道日报 · 2026-08-17
单一频道综合 · 已去重整理
今日一句话:DeepSeek 调价引发社区级“成本重算”,开发者一边寻找模型与订阅替代,一边面对 Codex、Claude、Grok、Qoder 等服务的额度收紧、上下文争议与稳定性问题。与此同时,AI 工具从编程延伸到语音、建模、文档处理和工作流自动化,但上游依赖与密钥安全风险同样被放大。
一、今日要闻
1. DeepSeek 调价成为全站主线,实际使用成本被反馈上升数倍
• 多位用户称,DeepSeek V4 Pro、V4 Flash 及依赖其上游的聚合服务在 8 月 17 日出现显著价格变化,原有“量大管饱”的使用逻辑被打破。
• 个案中,有用户续跑任务时,约 1 亿 Token 消耗 35 元;也有人报告同等项目的实际支出约为此前 5 倍,或称 Flash 用量成本上升约 2.5 倍。
• 社区讨论认为,峰谷计费、缓存命中率和中转商二次调价共同放大了体感差异;不能仅用标价判断真实成本。
• 影响:高频 coding、长上下文 Agent、文职批处理用户首当其冲,低价 API 生态正经历一次快速洗牌。
2. DeepSeek 上游变化向中转站和订阅产品传导,多个渠道被质疑缩水或涨价
• OpenCode Go、Command Code、部分自建或“自部署”名义服务被用户指出同步调整价格、额度或倍率,原先依靠低价 DeepSeek 建立的套餐优势明显减弱。
• 有用户称某 Pro 套餐在 5 小时窗口内仅完成约 5 个问题便耗尽额度,统计显示约 1300 万 Token,对计量合理性提出质疑。
• 另有用户反馈低价 DeepSeek 渠道出现高错误率、首 Token 响应慢、历史会话中断及客服响应不足等问题。
• 共识:低价不再等于低成本;稳定性、缓存策略、模型真实性和失败重试成本,正在成为选择渠道的核心指标。
3. Codex 生态出现 1M 上下文设置争议、额度重置收费及账号验证问题
• 多名用户尝试按 OpenAI Codex 负责人 Thibault Sottiaux 的公开提示,将上下文窗口从 200K改为 1M,但客户端实测仍会较早压缩,或从服务端缓存文件读取到约 372K / 832K上下文。
• API 模式默认上下文据称已提高到 1M,但不同客户端、订阅层级和服务端配置显示并不一致,部分用户未看到预期标识。
• 社区还出现 Codex 周限用尽后弹出付费重置的案例:据截图,Plus 用户可支付 8 美元重置至 100% 额度。
• 待确认:1M 是全量开放、灰度资格还是仅部分 API 路径生效;用户应以实际模型缓存、压缩节点和账单数据为准。
4. OpenAI Codex 被曝未来或接入 Astra,编程与安全能力值得跟踪
• 社区转引称,Codex 负责人确认未来将接入 Astra;该模型名称已公开但尚未正式发布,暂无明确上线日期与开放范围。
• 转述信息称,Astra 在 Agent 编程及网络安全内部评估中表现突出,OpenAI 曾因安全能力评估而暂停部分不符合新标准的内部活动。
• 影响:若消息属实,Codex 的模型层能力可能继续上探;同时,能执行复杂任务的 Agent 将面对更严格的安全边界与访问控制。
5. GPT、Claude、Grok 多线出现“更贵、更严或更不稳定”的用户反馈
• GPT Plus、Team 与 Pro 用户集中讨论周额度下降、消耗加快、手机号验证、将订阅放入中转后被封等问题;部分 Team 用户称周额度降至约 20 美元。
• Claude 侧,用户关注原有额外 50%周额度是否会在数日后到期,也讨论官网账号风控、Max 订阅是否值得升级及 Kiro 等替代接入。
• Grok 侧出现免费账号被标记、X 账号因互动频繁受限、Heavy 年付折扣转换规则复杂等反馈。
• 共识:账号池、共享分发、跨区支付与自动化高频调用的风险上升,官方订阅的稳定性也不再是绝对保证。
6. Qoder、智谱与多模型编程工具体验分化,Token 计量透明度被追问
• 用户称 Qoder 改版后套餐“更不耐用”,按其估算,原先约 150 Credits / 1M Token的消耗,现可能变为约 100 Credits / 1M Token;另有用户反馈 Qoder CN 响应慢且频繁提示网络繁忙。
• 智谱 Max 套餐也被质疑五小时额度消耗异常快;有用户记录约 343 次调用后即触及限制。
• 关于模型效果,社区测试显示 Qwen3.8-27B 在特定 SVG“黑洞”任务中表现超出预期,而部分 GPT-5.6 Sol 聚合线路在相同任务上疑似存在效果或速度波动。
• 影响:模型能力、路由渠道、思考强度、缓存与工具调用中断相互耦合,单纯以模型名比较已不够可靠。
7. Stripe 据报道以逾 70 亿美元收购 OpenRouter,AI 模型路由价值被资本重估
• 频道转引彭博消息称,支付公司 Stripe已完成对 AI 模型网关初创公司 OpenRouter的收购,交易金额超过 70 亿美元。
• OpenRouter 的核心能力是帮助客户按任务、预算和模型特性选择不同模型;其今年 5 月曾宣布完成 1.13 亿美元B 轮融资,估值约 13 亿美元。
• 为何重要:在模型价格波动、供应商频繁调整的背景下,统一接入、智能路由、账单治理和容灾能力正从“开发者便利功能”变为基础设施价值。
8. AI 语音与自动化工具继续落地,Qwen-Audio-3.0 上线
• 阿里云宣布 Qwen-Audio-3.0系列上线千问 AI 平台及阿里云百炼,覆盖 ASR 语音识别、TTS 语音合成和实时语音对话。
• 频道转引信息称,该系列在 Artificial Analysis 今年 7 月榜单中位列语音识别、实时交互、语音合成三个赛道第一。
• 同日,豆包输入法 Windows 内测版加入小鹤、自然码双拼;“工作任务”模式则新增手机远程操作电脑能力。
• 影响:语音输入、实时助手与桌面自动化开始形成可组合工作流,开发者更关心准确率、时延和私有数据边界。
二、分主题深读
🤖 AI 与算力
• 峰谷计费改变使用行为:DeepSeek 调价后,用户开始讨论是否应让公益站、中转站采用更动态的价格机制,以在高峰期抑制拥堵、在低谷期吸引批处理流量。反对意见隐含在用户体验中:价格过于频繁变化会增加预算不确定性。
• 缓存命中率成为账单关键变量:针对“简单问题烧掉十余元”的争议,有用户按账单拆解称,数百万输入 Token 中,未命中缓存部分若按高峰价格结算,可占绝大多数费用。长会话不是天然省钱,复用上下文与缓存策略更重要。
• 模型替代需求激增:社区频繁比较 DeepSeek、Kimi K3、GLM、Qwen、Luna、Terra、Sol、Claude Fable 等,希望为翻译、总结、上下文压缩、小型代码修改和重型 Agent 分别寻找更合适的模型。
• 本地部署仍有现实门槛:有用户咨询 RTX 5080 16GB 用于 AI 视频、本地模型与 YOLO 后的进阶方案;另有公司采购方案在 RTX 4060 16GB 与 RTX 4090 24GB、64GB 内存之间权衡开发、爬取和本地推理需求。显存仍是本地 AI 工作流的硬约束。
• AI 视频与换脸需求强调隐私:业务方称云端换脸按秒计费过高,且因涉及用户隐私不适合普通中转。讨论指向私有部署、专有云和数据最小化,而非仅追求模型效果。
🧑💻 编程工具与开发实践
• Vibe Coding 从“让 AI 写代码”转向流程治理:用户分享实践为先以 Plan 模式明确需求和约束,再以高思考强度执行,最终人工测试与 Review。讨论重点已不只是 Prompt,而是如何减少返工、管理上下文和验证交付结果。
• OpenCode V2 被视为破坏性升级:体验者指出,V2 的 Plugin API 与 V1 不兼容,许多依赖动态上下文裁剪等能力的插件尚未迁移;但部分 PTY 类插件功能已被新版 Shell 原生支持。升级前需评估插件链路,而非直接覆盖安装。
— message 1 of 3 —