📡 Linux.do 频道日报 · 早报
有效消息 165 条

📡 Linux.do 频道日报 · 2026-08-30
多源综合 · 已去重整理

今日主线:频道讨论高度集中在 AI 订阅额度、Codex 重置与 Claude 周限调整,围绕官方订阅、中转、反代和风控的稳定性博弈持续升温。与此同时,国产模型的实际编码与数学能力、Qwen3.8 本地部署、Windows 更新事故及 VPS 安全事件,也成为技术讨论的主要焦点。


一、今日要闻

1. Codex 额度在凌晨出现集中重置,明日是否再次重置仍有争议
• 多名用户反馈 8 月 30 日凌晨至清晨陆续收到 Codex 额度重置,时间集中在约 05:24 前后,Pro、Team 等账户均有报告。
• 此前社区持续等待重置,部分用户甚至担心活动取消;重置到账后出现“猛猛蹬”的集中使用现象,也有人因 5 小时限制、模型速度或风控无法充分消耗。
• 有用户转述 Tibo 的说法,暗示后续可能还有新的重置安排,但“明天是否继续”目前只是社区解读,尚无确定结论。
• 影响:短期内 Codex 使用量、官方订阅性价比和账号风控讨论将继续升温。

2. Claude 套餐周限额将于 9 月 14 日永久提高 25%
• Pro、Max、Team 以及按席位付费的 Enterprise 套餐,标准每周限额预计从 9 月 14 日起永久上调 25%。
• 在此之前,现行的 50% 临时限额提升福利据称会持续到 9 月 13 日;活动结束后,用户实际可用额度相较当前活动期会下降,但仍比原标准高。
• 频道用户同时关注 Max 20x 的实际体验,包括长对话或高消耗任务中模型质量明显下降、思考预算消耗较高等问题。
• 补充:额度上调不等于单次任务稳定性同步改善,长时间 Claude Code、Cowork 和多轮对话仍需观察。

3. 官方订阅与中转、反代之间的稳定性和风控差异成为集中投诉点
• 有用户反馈 CPA 返代后 Codex Plus 额度疑似明显减少,也有人遇到 Team 账号突然要求手机号验证、ChatGPT 或 Google 账号被封、申诉必须验证原始手机号等情况。
• 另有用户认为官方客户端更容易触发某些安全或网络相关限制,而通过反代、第三方客户端调用时表现不同;这类差异可能与账号状态、请求环境、工具调用链和风控策略有关,频道内尚无统一结论。
• Claude 接入第三方模型后,自动模式可能卡在安全分类器,出现模型暂时不可用、任务无法继续的问题;Codex、Claude Code 也被讨论到上游波动导致夜间任务中断。
• 风险提示:账号共享、代充、黑卡、异常 IP 跳变及未经确认的第三方中继,都可能导致额度异常、支付失败或账号限制。

4. GLM-5.3 Flash、Qwen3.8、Kimi K3 等模型的“低价高量”与实际能力继续被横向比较
• 有用户实际消耗约 3 亿 GLM-5.3 Flash token,认为其执行能力不错,但深度思考仍有不足;另一些体验则指出 GLM-5.3 思考时间过长,甚至在简单任务上长时间停留后才执行基础命令。
• Kimi K3 被认为在部分任务中具备竞争力,但回复时间长、代码冗余和套餐成本较高的问题也较突出;Hy4 的数学与推理能力受到关注,同时有用户反馈其思考时间过长、Token 效率低,简单题也可能迟迟不执行。
• DeepSeek V4 Flash 速度快、价格低,但有生产用户指出其容易遗漏上下文要求或忘记 `agents.md`,难以完全放手运行。
• 频道共识:模型能力不能只看榜单或单次演示,长上下文、工具调用、任务完成率和单位成本更能决定真实生产价值。

5. Qwen3.8-27B 本地推理与多显卡实测资料受到关注
• 频道出现基于真机的横评:RTX 3090 24G 主要使用 Q4_K_M,实测上下文约 32K 至 128K;4090、5090、V100 则覆盖更高上下文或 FP8、NVFP4 等配置,但具体速度与可用上下文高度依赖推理框架、量化方式和显存。
• 另有用户准备在 Dell 7920、RTX 3090 24G、128G 内存环境中部署 Qwen3.8-27B,并考虑增加第二张 3090;M1 Max 32 核 GPU、64G 内存用户也在询问本地运行 Qwen3.8 及 Agent、PPT 工作流的可行方案。
• 预算约 7 万元的本地推理方案中,DGX Spark 双机与高内存 Mac Studio 被拿来比较:前者生态更成熟,后者拥有更大的统一内存带宽,但软件生态和兼容性仍需权衡。

6. DMIT 通报客户虚拟机上的 SNI 代理被利用,峰值流量接近 100 Gbps
• 据频道转述的通报,8 月 26 日 16:00 至 18:00,美东时间出现规模不大但特征异常的试探性流量;次日凌晨 3:00 至 4:00,网络边界流量短时接近 100 Gbps。
• DMIT 判断流量并非传统意义上的直接 DDoS,而是客户虚拟机中部署的一类 SNI 代理应用被第三方利用。服务商已通过邮件通知,并对确认存在开放代理行为的实例执行关机。
• 部分实例恢复后未完成整改,导致缺陷再次被利用。事件显示,低峰期探测与后续大规模滥用之间可能存在明显的筛选和准备阶段。
• 运维重点:检查代理监听范围、认证机制、访问控制、日志和异常出站流量,避免将 VPS 变成开放转发节点。

7. Windows 近期更新被指引发桌面异常、Codex 崩溃及绿屏
• 频道用户称,KB5120998 及相关 24H2、25H2、26H2 版本可能导致鼠标指针、壁纸异常;另有测试版本被指与 Codex 崩溃、系统绿屏有关。
• 使用 Qoder、WorkBuddy 等带 Agent 或沙箱机制的工具时,有用户观察到桌面崩溃重启现象,但目前仍属于个案反馈,尚不能确认全部问题均由同一更新造成。
• 建议:生产环境暂缓升级高风险预览版本,保留恢复点,并核对具体系统版本、驱动及崩溃转储后再判断根因。

8. OpenAI 与泰国政府成立 AI 加速器,面向健康、保健和教育初创企业
• OpenAI 与泰国高等教育、科学、研究与创新部宣布成立加速器,帮助本地团队将原型转化为可实际部署的产品。
• 首批聚集 10 家初创公司,方向覆盖健康、营养、教育和机器人等领域,合作方包括泰国国家创新局、玛希隆大学和 Techsauce。
• 这是 OpenAI 与泰国政府首次开展公私合作,反映模型厂商正通过本地生态、政府合作和行业应用扩大区域影响力。

二、分主题深读

🤖 AI 模型与 Agent

• 国产模型真实体验分化明显:GLM-5.3 Flash 在长时间编码任务中被评价为执行力较强,但深度与稳定性仍有短板;Hy4 被认为在数学方向投入较多,却出现长时间思考、低 Token 效率和工具调用失败。Qwen3.8 被部分用户视为当前国产模型中的“刷分王”,但榜单表现与实际工作流表现尚需拆开评价。

• Agent 是否值得研究,讨论从“能不能做”转向“怎么编排”:频道用户认为,当前 Agent 的主要价值已不只是让模型自动写代码,而是通过任务拆解、工具调用、记忆、检索、循环和失败恢复,将多个能力不同的模型组合起来。未来 Harness 可能采用多 Agent 协作,让主模型负责规划,其他模型分别承担前端、数学、搜索或执行任务。

• AI 写代码已覆盖中等规模 CRUD 项目的大部分工作:有开发者根据实际项目经验估计,在 Angular、Java Spring、微服务和中等并发场景下,AI 可完成约 70% 至 90% 的结构搭建、常规业务逻辑和实现工作。仍需人工重点把关的部分包括关键业务规则、事务一致性、边界条件、权限、安全、性能和最终测试。

• 上下文变长后,模型质量可能出现阶段性下降:Claude 用户反馈,在 Web、Desktop、Cowork 或 Claude Code 中,连续多轮对话或消耗较大上下文后,Fable、Opus 等模型可能出现“跳答案”、事实核对减少或行为明显变弱的情况。另有 Kiro 反代用户称,同一 Claude 模型在不同线路和客户端中的幻觉、执行完整度差异很大,说明上游版本、代理层处理和上下文注入都可能影响体验。

💻 编程工具与开发实践

• Vibe Coding 入门需求持续增加:零基础用户希望依靠 AI 跳过完整语法学习直接做项目,但频道讨论普遍认为,AI 可以降低环境配置和初始编码门槛,却不能替代对目录结构、依赖管理、错误日志、版本控制和基本调试的理解。

— message 1 of 2 —