📡 Linux.do 频道日报 · 晚报
有效消息 553 条

📡 Linux.do 频道日报 · 2026-08-16
多源综合 · 已去重整理

今日一句话:Linux.do 的讨论主线高度集中在 AI 编程工具、DeepSeek Harness 生态和订阅额度管理上。模型能力快速迭代的同时,额度缩水、渠道不稳定、账号风控、插件成熟度和中转可信度,已经成为比“模型排行榜”更现实的使用成本。


一、今日要闻

1. DeepSeek Harness 社区持续升温,但距离稳定生产仍有距离
• 频道内出现额度监控、用量仪表盘、桌面窗口、PWA 封装、插件组件复用、TUI 宠物提醒以及插件安装与 WSL 文件访问等一系列实践分享,说明 DSH 已从单纯尝鲜逐渐进入真实开发和日常工作流。
• 有用户认为 DSH 的插件生态活跃度已经超过部分同类工具,但官方仍处于开发者预览阶段,插件说明、安装方式、Web 启动稳定性和跨平台兼容性仍不够完善。
• 多名用户反馈,安装插件或折腾 Web UI 后容易出现启动报错;Windows 用户在 WSL 中使用时,还遇到无法直接选择 Windows 项目的问题。
• 影响:适合愿意排查环境、维护插件的用户试用;重要项目仍应保留官方 Harness 或其他工具作为备用路径。

2. DSH 插件与路由方案被用于验证 DeepSeek V4 系列能力
• 社区用户通过 dsh-routing-suite、官方 Harness 和不同推理模式,对 DeepSeek V4 Pro、V4 Flash 以及 Grok 4.6 进行了真实项目重构、图像生成和工程任务对比。
• 一项以“将发卡系统重构为 Go”为目标的测试中,发帖者给出的结果是:DeepSeek V4 Pro 配合路由插件约 83.8 分,Grok 4.6 约 80.3 分,但该结果属于个人测试,且 Grok 任务中据称获得了 GPT 5.6 的辅助,不能视为统一基准结论。
• 另一组 V4 Flash 对比认为,使用 dsh-routing-suite 和官方 Harness 配合后,模型在图像效果和任务完成度上更稳定;也有人反馈 Flash 当天明显变笨,或思维链起手词发生变化。
• 共识:Harness、路由和提示流程可能显著影响体验;分歧:插件带来的提升究竟来自路由、提示词、上下文管理,还是上游版本变化,尚未被严格拆分验证。

3. AI 订阅与额度焦虑进一步扩散
• 有用户统计自己近五个月使用了超过 400 亿 Token,部分 Pro 套餐在高强度 Agent 工作下仅能使用一天至一天半;另有 Pro 20x 用户单日 Token 总量超过 5.4 亿。
• Zcode 的“一亿 Token”新用户额度被多名用户反馈在半天或使用过程中耗尽,具体消耗规则和额度恢复方式引发疑问。
• Codex、ChatGPT Team、Claude、DeepSeek 和 OpenCode Go 均出现额度重置、额度缩水、套餐升级退款、订阅到期后补偿额度是否保留等咨询。
• 讨论逐渐从“哪个模型更强”转向“如何根据任务分层使用模型”:简单任务使用低价或 Flash 模型,复杂任务再切换高阶模型,并借助缓存、上下文压缩、用量统计和自动路由降低成本。

4. 模型与渠道稳定性成为实际使用的核心变量
• DeepSeek 网页版出现“服务器繁忙”提示,V4 Flash 是否已经正式接入网页端和 App 也有用户询问;部分用户认为 Flash 当天出现能力波动。
• Codex 更新后,有人遇到切换对话卡顿、鼠标响应异常和持续“重新连接”;OpenCode Go 则被反馈存在服务器断流,导致无人值守任务中止。发帖者通过修改客户端源码,增加每 10 秒一次的重试轮询。
• 社区对不同中转站的模型标签、思维链格式和实际能力存在明显不一致反馈,甚至出现疑似掺水、模型标注不实的投诉。
• 提醒:中转站的倍率、账号池、路由和缓存策略可能改变实际模型;截图或“鹈鹕骑自行车”等演示不能替代代码修复、静态分析和长程任务测试。

5. GLM-5.3 与国产模型套餐性价比受到集中关注
• 频道内多次讨论 GLM-5.3 的 Agent 价格、编程能力、视觉生成和“鹈鹕骑自行车”测试。部分用户认为新人套餐约 49 元具有吸引力,但仍需观察后续是否降智或调整额度。
• 有测试认为 GLM-5.3 在简单推理和部分 HTML 动画任务中反应较快;但在约 10K Token 的着色器代码静态分析中,发帖者记录到 GLM-5.3 未能稳定找出数组越界问题,Grok 4.6 则曾成功但表现也不稳定。
• 千问办公宣布上线 GLM-5.3 和 DeepSeek V4 Pro,用户可在“前沿模型”档位直接选用。相关报道提到,V4 Pro 支持 100 万 Token 上下文、最高 384K 输出;GLM-5.3 则强调后训练 Scaling 和长程工程任务能力。
• 结论:GLM-5.3 的视觉展示和低价体验受到好评,但工程可靠性仍应通过真实代码库、漏洞修复和回归测试验证。

6. 账号风控与低价订阅渠道风险集中暴露
• 有用户反馈四个 Kiro 账号同时出现鉴权失败,其中包括正价账号和长期用于反代的免费账号,页面要求进行身份验证;也有人担心 Google 账号注册频繁失败、X 账号封禁导致 Grok 无法登录。
• Cursor 用户集中询问免费额度触发规则、Demand 额度突然重置、网络中断导致思考结果丢失,以及 Cursor 被收购传闻后 Pro 和内置模型是否受影响。目前频道消息未提供官方确认。
• 低价 OpenCode Go、Claude、Grok、GPT 和各种号池、中转服务持续出现,但部分帖子明确标注“渠道不明”“价格异常便宜”或仅凭个人体验,稳定性和账号来源均无法确认。
• 风险:共享账号、反代、批量注册、异常 IP、公开 API Key 以及未经核验的优惠渠道,都可能带来封号、数据泄露、余额损失或责任追溯问题。

7. AI 应用开始深入学习、研究和个人工作流
• 有用户用 DeepSeek Harness 以约 0.35 元、约 10 分钟生成通信工程师交换技术考试的 30 天冲刺资料,计划在九月考试前验证 AI 辅助学习效果。
• 频道用户还在寻找辅助学习的 Skill、Agent 体系、教育培训行业工作流,以及能处理知识库和训练对话的微信视觉客服智能体。
• 一项启发式调度编程比赛的分享显示,即便同时使用本地模型和 GPT Pro,经过十几个小时迭代仍落后于其他参赛者,发帖者开始重新思考提示词、工具编排和人类干预的边界。
• 趋势:AI 正从“问答工具”转向学习规划、资料生成、代码重构和持续运行的 Agent 系统,但最终质量仍取决于评测设计和人工复核。

8. 航天、开源硬件与 Linux 桌面动态受到关注
• SpaceX 在 8 月 15 日实现两次轨道级发射间隔仅 38 分钟,刷新其 2024 年创下的纪录;报道提到星链在轨卫星已接近 1.1 万颗。
• 中国在海南商业航天发射场使用长征十二号,成功将卫星互联网低轨 24 组卫星送入预定轨道,这是长征系列运载火箭第 663 次飞行。
• 中国队在第 38 届国际信息学奥林匹克竞赛中获得 3 金 1 银并取得团体第一,许淇文以 498.27 分排名全球第一。
• Linux 相关讨论中,openSUSE 更新 Mesa 26.2 后被反馈访问 QQ 和 Firefox 会触发 i915 hang;KDE Plasma 6.8 计划改进远程桌面共享剪贴板、鼠标和触摸板速度调节以及 Flatpak、Nix 应用固定体验。

二、分主题深读

🤖 AI 模型与编程能力
• 真实代码测试取代单一视觉演示:频道内有用户批评只用“鹈鹕骑自行车”评测模型过于片面,转而测试 Bug 修复、代码迁移、功能添加和静态分析。已有分享显示,不同模型在简单演示中表现亮眼,但面对隐藏较深的数组越界、长程重构和实际工程上下文时,结果可能完全不同。
• GPT 5.6-Sol 的执行力与僵化问题:用户认为其指令遵循能力较强,但 Skill 中写死的步骤可能被无条件执行,即使已经失去必要性,也会继续消耗本就紧张的上下文。另有反馈称模型会机械生成测试,测试覆盖固定场景,却可能通过针对场景调参来“伪装正确”。
• 模型降级与路由疑问:有用户发现所谓 Sol 路由到 Terra,怀疑与账号被封后重新开设、套餐分组或中转配置有关;也有人发现 Fable、Opus 在 VS Code 中自动退回 4.8。以上均为个人观察,尚缺乏官方确认。

— message 1 of 2 —