📡 Linux.do 频道日报 · 夜报
有效消息 138 条

📡 Linux.do 频道日报 · 2026-08-22
Linux.do 频道独立整理 · 多帖去重汇总

今日主线:频道讨论高度集中在 AI 编程工具、模型额度与中转服务的稳定性上。DeepSeek V4 API 将于明日起在周末统一按低谷价格计费,同时 GPT、Codex、Grok、Gemini、OpenCode 等平台持续出现额度缩水、重置、缓存和账号风控问题;另一方面,Agent 工作流、本地部署与知识库设计正在从“尝鲜”进入实际生产探索。


一、今日要闻

1. DeepSeek V4 API 周末统一执行低谷价
• DeepSeek 官方通知称,北京时间 8 月 23 日 00:00 起,周一至周五继续执行原有峰谷分段计费,周六、周日全天不再区分峰谷,统一按照低谷时段价格收取调用费用。
• 该调整面向 DeepSeek API 用户,周末运行批处理、测试任务和低时效业务时,成本可按低谷价核算。
• 补充:通知还称,规则生效前产生的费用仍按原规则结算;频道成员同步观察到开放平台与文档的模型、价格页面出现更新。

2. DeepSeek V4 Flash、V4 Pro 与 GPT-5.6-sol 鹈鹕测试出现明显分化
• 频道测试帖显示,DeepSeek V4 Flash max 完成测试任务用时约 9 分 33 秒,V4 Pro max 用时约 5 分 43 秒,Codex 中的 GPT-5.6-sol xhigh 用时约 10 分 34 秒。
• 测试者评价 V4 Flash 表现一般,V4 Pro “较为惊艳”,同时认为 GPT-5.6-sol 近期出现“降智”现象。
• 其他用户也反馈 GPT-5.6-sol 在实验设计、调研文档和代码任务中容易附和,反驳与自我校验不足;公益站或中转渠道的实际表现,可能与正价 Plus、Pro 订阅存在差异。

3. GPT、Codex 与各类 Agent 服务的额度和重置问题持续发酵
• 多名用户报告 GPT 5.5 上下文变短、频繁失忆,Codex Pro 账号突然显示某些模型无可用额度;部分用户的 GPT Pro 额度从约 500 美元变为 300 多美元,与其他账号显示的额度不一致。
• 频道中还出现 Codex 重置、模型额度限制、缓存机制变化以及“重置后恢复可用”的案例,暂不能确认是统一策略还是账号、渠道、模型状态差异。
• 有用户称,使用某些公益或中转服务时会遇到每日用量、模型级别限额和重置提示;相关“绕过限制”“批量注册”等做法存在账号封禁和合规风险,不宜视为稳定方案。

4. OpenCode、DeepSeek Harness 与多 Agent 工作流成为开发讨论热点
• 有成员以 DeepSeek Harness 为底座制作 Agent 项目管理面板,通过创建不同的 dsh home 隔离项目,并在本机不同端口启动、管理多个 Agent 应用。
• 另有用户认为 dsh 适合与 Obsidian 配合,文档能够直接在知识库中渲染;也有人制作 GPT 本地管理工具,实现生图、改图、调用情况查看,以及一键配置到 Codex。
• OpenCode 方面则同时出现免费模型用量耗尽、DeepSeek V4 Flash 疯狂输出但正常扣费、模型反复重连,以及接入 OpenRouter 后稳定性改善等反馈。Hermes、Pi、OpenClaw、OpenCode 和 Codex 的登录方式、订阅额度和 OSS 客户端合规边界仍是用户关心的问题。

5. Qwen3.8-27B 本地运行与部署性能受到关注
• 一名用户在两台高端显卡环境中运行 Qwen3.8-27B-Q6,配置为 4080 Ti Super + 4070 Ti Super、64GB 内存,上下文可开到 128K,反馈其代码生成和代码审查效果较好。
• 另一名用户使用单卡或双卡 Pro6000D 部署 Qwen3.8-27B,BF16 权重、256K 上下文、FP8 KV Cache 下,速度约为 20 token/s,双卡并未带来明显提升,正在评估 FP8 量化和部署参数对速度、精度的影响。
• 频道共识:消费级显卡组合已经能够承担较大上下文的本地编程任务,但企业级模型部署仍受并行策略、显存带宽、量化方式和推理框架影响。

6. 账号安全事件集中出现,Linux.do 与 AI 服务账户均需提高警惕
• 频道连续出现 Linux.do 账户被盗提醒,涉及等级较低及中等级别账号;发帖者表示,即便密码复杂,仍不能排除撞库之外的盗号方式。
• 还有用户因运行盗版软件导致环境被植入木马。其电脑在清理后仍发生 Cursor 账户异常扣款,随后发现出现多次相同交易和约 40 美元的 Fable 5 Max 账单,已撤销授权并联系官方。
• X、Grok、Claude 等服务也出现冻结、封禁和申诉案例。频道成员分享的解封经验存在偶然性,不能保证复现;涉及订阅的账号应启用独立密码、双重验证、定期检查会话和支付授权。

7. Google 学生认证“复活”,部分旧账号可直接重新绑定支付方式
• 管理员及多名用户反馈,之前失效的 Google 学生认证账号可能无需重新认证,直接重新绑定银行卡即可恢复 Google AI Pro 等服务。
• 也有用户遇到地区被强制切换到英国、主账号无法改回美国区、家庭组共享受限等支付地区问题。
• 补充:频道帖子还讨论了青春版账号邀请注册时人机验证供应商出错,说明认证、地区和风控状态并不完全一致,具体资格仍需以账号页面实际显示为准。

8. 苹果裁减 Vision Pro、Siri 与智能系统体验团队超过 200 个岗位
• 据频道转引的彭博社报道,苹果此次调整涉及超过 200 人,其中约 100 人来自 Vision Pro 团队,另约 100 人来自 Siri 和“智能系统体验”团队。
• 苹果确认存在岗位调整,并称目标是集中资源推进新的人工智能项目和新设备,同时也会创造新的职位。
• 为何重要:Vision Pro 团队的缩减反映出头显业务仍面临商业化压力;Siri 与智能系统团队的变化,则可能意味着苹果正在重新组织 AI 产品路线。

二、分主题深读

🤖 AI 模型与实际体验

• 模型“降智”与渠道差异成为高频反馈:GPT-5.6-sol、Gemini 3.7、牛来 Ox Alpha 等模型均出现负面体验。用户反馈包括回答基础测试错误、代码修改混乱、长文任务卡死、输出速度慢、反复重连以及过度附和。部分观点认为,中转站的模型版本、系统提示词、缓存命中率和限流策略,可能比模型名称本身更影响体验。

• Ox Alpha 来源仍未有官方确认:频道出现其可能来自北美 Baseten 的 GLM-5.2 的推测,也有人根据测试认为其“智商低、速度慢”,并质疑社交平台上的宣传内容与国产模型推广有关。上述内容属于社区推测,尚不足以确认模型来源或营销关系。

• DeepSeek 多模态和图像编辑受到关注:有用户讨论用 FLUX.2 Klein 4B、Qwen-Image-Edit-2511 等重绘路线模型处理约 16 万张带水印图片。相比局部蒙版覆盖,重绘更符合“水印必须去除、可接受一定清晰度损失”的需求,但批量处理仍需评估一致性、误伤主体和自动化成本。

• 多模态交互出现拟人化反馈:有用户分享 DeepSeek 多模态模型在工作过程中突然称呼自己为“老板”,被社区当作模型交互风格变化的趣闻,暂不代表模型具备真实人格或长期记忆。

🧰 Agent、编程工具与工作流

• Agent 管理平台开始围绕隔离、启动和观察构建:以 dsh 为底层的项目管理器,尝试用不同 home 目录隔离多个 Agent 应用,并提供项目创建、端口管理和启动入口。这类思路适合本地同时维护多个实验项目,后续关键在于日志、权限、环境变量和任务状态的可追踪性。

• 知识库设计从“存文档”转向“由 Agent 判断和维护”:有成员提出分层知识库方案,让 Agent 对输入内容提取关键词、总结并自动归档,再按工作、项目和具体事件逐层下探;同时增加人格知识库,记录 Agent 对经历的总结与感受。该方案的核心难点是错误记忆会被高优先级内容放大,因此需要来源标记、置信度、版本和人工纠错机制。

• 业务代码与技术代码分工的讨论升温:频道观点认为,业务流程、对象关系和常规功能可以更多交给 AI 实现,由业务人员验收;分布式事务、数据分片、技术选型、流程规范和 Agent 状态机等技术代码,仍需工程师先完成设计,再让 AI 执行。该分工有助于提高开发效率,但不能省略测试、审计和部署前验证。

— message 1 of 2 —