📡 Linux.do 频道日报 · 晚报
有效消息 425 条

📡 Linux.do 频道日报 · 2026-08-28
多源综合 · 已去重整理

今日一句话:频道讨论高度集中在 AI 模型与订阅生态的剧烈波动上——额度、5 小时窗口、路由、封号和中转质量问题频发;与此同时,腾讯混元 HY4、智谱 GLM-5.3-Flash、Kimi K3 等模型在前端开发、视觉生成和复杂推理上的表现引发密集实测。


一、今日要闻

1. AI 订阅额度与限额成为频道最集中投诉点
• 多位用户反馈 GPT Team、Plus 及 Codex 相关账户的额度规则不稳定,部分账号在 5 小时窗口、7 天额度和周限额之间变化,额度显示也出现昨日仍有余额、次日明显下降的情况。
• 有 Team 用户称,5 小时窗口实际只剩约 15M~22M tokens;另有用户观察到,账号在重置后从 5 小时限制变为 7 天限制,但具体触发条件仍不明确。
• GPT-5.6-Sol、Ultra 等高强度模式消耗尤其明显,长任务可能在数小时内用掉大量周限额。补充:以上均为频道用户个体实测,不能据此推断所有套餐统一调整。

2. GPT-5.6-Sol 的体验与成本争议持续升温
• 多条反馈认为,Sol 最近出现“变蠢”、过度设计、理解项目不准确、代码审查迟迟不结束等现象;也有用户认为模型本身没有退步,问题可能来自中转路由、缓存或服务端负载。
• 在 Codex CLI 中,复杂项目配合子代理执行时,思维链更长、耗时更久、token 消耗显著增加。一项实测中,5 个多小时的全栈任务让 GPT 5x Pro 周限额下降约 15%;另一位用户称,一次代码审查请求消耗达到数十美元级别。
• 频道经验倾向于认为,GPT 更适合关键节点和复杂任务,长期连续开发则需要拆分任务、限制上下文、减少无效重试,并准备成本更低的替代模型。

3. 腾讯混元 HY4 实测表现受到明显关注
• 多位用户测试了 HY4 在鹈鹕骑车、长颈鹿打螺丝、糖果题、水杯配对、Three.js 武装直升机和网页小游戏等任务中的表现。
• 有测试者认为,HY4 在“鹈鹕骑车”和部分前端生成任务中的完成度已经接近甚至打平 Opus 5、Kimi K3;另有用户评价其在“见缝插针”类推理对话中强于 GLM-5.3-Flash 和 DeepSeek V4 Flash Vision。
• 但并非所有反馈都正面:部分测试称模型几乎不展示思考过程,生成的小游戏仍有 bug;也有人认为 HY4-Preview 风格偏保守,能完成要求但不主动美化,和此前版本风格相近。
• 综合来看,HY4 的优势主要体现在网页、SVG、交互原型和特定题型,复杂任务的稳定性及隐藏思考机制仍需进一步验证。

4. 智谱 ZCode 周末发放 3 亿 Token,用户关注实际可用时间
• ZCode 更新到最新版后,部分用户领取到周末 3 亿 Token额度;相关讨论显示,领取入口和消耗统计位置并不直观。
• 有用户称额度从晚上 20:00生效、下周早上 9:00失效,担心“名义额度很高但有效窗口过短”;也有人反馈免费账号持续显示“系统繁忙”,无法正常调用。
• GLM-5.3-Flash 的测评反馈较前期明显改善,综合表现被认为接近 API 水平;不过不同客户端、套餐和渠道的可用性差异较大。

5. Kimi K3、商汤 Token Plan 与多家模型渠道出现新变化
• 商汤 Token Plan 被用户发现改为积分计费模式,并上线 Kimi K3;另有帖子称商汤 coding plan 公测期间免费开放 K3,周限制约为 600,000。
• 部分用户认为 Kimi K3 速度快、前端能力不错,但也担忧 token 消耗较快、渠道响应速度异常,无法排除缓存或服务策略差异。
• Kimi 官方订阅与 Allegro、API、中转站之间的性价比成为新问题,用户主要比较 token 消耗、上下文缓存、排队情况和套餐限额。

6. 账号封禁与风控案例密集出现
• 有 Claude Pro 用户在订阅后一天被封,推测可能与支付方式、网络频繁重连、地区环境或账号使用行为有关;也有用户称自己“养”的 Claude 账号因询问热点话题而陨落,但该案例无法证明触发原因为提示词本身。
• GPT 账号出现无法付款、订阅失败、异常活动拦截等情况;Discord 注册和手机号验证也有短信收不到的问题。
• Team 反代、多人使用、动态住宅 IP、CPA 及账号轮转等做法被反复讨论。频道普遍担忧平台会综合识别 IP、设备、登录地、使用模式和子账号行为,相关经验不具备稳定性。
• 有关“破甲”“绕过风控”“批量注册”的求助较多,但这些操作本身可能违反平台规则,且存在账号、支付和数据安全风险。

7. 中转站质量、计费透明度与安全性受到质疑
• 用户反馈不同中转的模型可能存在路由错误、降级、缓存异常、上下文丢失、API 401/403、Codex 卡死和调用不稳定等问题。
• 有人使用 Grok 4.6 处理单个问题时,月额度迅速下降约 5%,但按明细计算实际只消耗约 1 美元;另有用户认为中转每月成本达到 400 元,反而高于官方 coding plan。
• Hub 站的充值和兑换存在延迟,单日转入上限约 2,000 LDC,高并发开发场景容易出现余额断档。
• 频道还出现“公益站暂停”“公益站无法获取模型”“API 错误”和疑似冒充官方的诈骗信息。任何所谓低倍率、首充翻倍、赠送额度的服务,都应先核实运营主体、余额规则、隐私政策和退款条件。

二、分主题深读

🤖 模型能力与评测

• 前端与可视化生成:HY4、GLM-5.3-Flash、Kimi K3 和腾讯混元成为今日前端能力的主要比较对象。测试覆盖 SVG 动画、Three.js 建模、网页版沙盒游戏、赛车和管理后台等场景。频道反馈显示,模型已经能一次性生成可运行原型,但 UI 审美、交互细节、错误修复和长任务稳定性仍明显依赖人工验收。

• Opus 5 与视觉生成:有用户认为 Opus 5 生成的 SVG 质量不如参考站其他案例,出现“海绵宝宝骑自行车”形变严重的问题;也有实测认为模型持续更新后并未退步。较合理的判断是,效果高度取决于提示词、参考图、输出格式约束和任务拆解,单个失败样本不足以说明模型整体退化。

• 如何判断模型降智或被降级:频道用户建议使用固定题集进行多轮对照,覆盖代码修改、结构化 JSON、数学推理、长上下文检索、视觉理解和工具调用,并记录模型版本、渠道、参数、延迟、缓存命中和输出长度。只比较单次回答,容易把随机性、路由差异和服务负载误判为“降智”。

• 小模型与本地部署:有项目需要不超过 9B 参数、支持 JSON 结构化输出的非思考模型。讨论认为,经过针对性微调的小模型有机会在单一任务上超过通用大模型,但必须配合严格数据集、评测集、格式约束和失败重试机制。M1 Pro 32G 用户还分享了本地运行图像识别模型的体验,速度和识别能力基本可接受。

🧑‍💻 Codex、Claude Code 与 Agent 工作流

• 上下文和任务拆分:Codex、Claude Code 被大量用于完整项目、论文、代码审查和多代理协作。用户普遍发现,大型需求应先拆成规格、数据模型、接口、前端、测试和验收阶段,否则高强度模型容易长时间运行并快速消耗额度。

• 多 Agent 协作:频道出现多个 Codex 工作流和全局 Agent 配置分享,包括通过 AGENTS.md、子代理目录和 fastctx MCP 管理长任务,也有人将 computer-use 和 goal 能力整理成 skill。实践重点从“让模型写代码”转向“让多个代理分工、执行、测试、验收”,但如何避免并行任务冲突、重复修改和无人负责的最终验收,仍是主要难点。

• 工具故障:Codex CLI 有用户反馈无法访问工作区终端或文件编辑能力,最新版本还出现 TUI 不显示 AI 执行过程的问题;VS Code Codex 插件更新后界面异常,部分用户无法恢复旧体验。Sub2API 调用 Codex 也有卡在“查询”或“编辑”阶段、没有后续 API 请求的情况,暂停后重新启动才能继续。

• 开发规范:有公司准备为 4~5 名开发人员制定统一 AI Coding 方案,备选方向包括官方订阅分配、可靠中转、国内模型和统一账号管理。频道建议重点评估数据合规、代码保密、审计记录、预算上限、模型切换、人工 Review 和故障兜底,而不是只比较套餐价格。

🔐 账号、隐私与基础设施安全

— message 1 of 2 —