📡 Linux.do 频道日报 · 午报
有效消息 244 条

📡 Linux.do 频道日报 · 2026-09-14
多源综合 · 仅整理 Linux.do 频道内容

今日主线:频道讨论高度集中在 GPT-6/Astra、Codex 等模型的“降智”、限额、容量不足与反代风控,用户开始在官方订阅、国产模型和多模型工作流之间重新寻找平衡。与此同时,Giffgaff 退款案例持续增加,国庆出行、硬件涨价、存储与 AI 基础设施也成为高频话题。


一、今日要闻

1. GPT-6/Astra“降智”与路由异常成为全频道焦点
• 多名用户反馈 Astra、5.6 系列在同一账号、同一模型下出现回答变短、答非所问、代码错误增加、工具调用混乱等现象;部分用户认为问题可能与账号、IP、反代方式或后端路由有关。
• 有用户称,直接登录账号使用时未明显遇到降智,但将同一账号放入 Sub2API、CPA 或其他反代环境后,问题明显增加;也有人更换 IP 后仍无改善,说明目前尚不能确认单一原因。
• 频道出现基于“鹈鹕测试”、知识库问答、SVG 任务以及 reasoning token 占比的检测思路,部分测试显示 Astra 表现正常,另一些测试则疑似被路由到 Luna 或其他模型。
• 补充:相关结论主要来自社区实测与推断,尚未形成官方解释;“At capacity”与降智是否存在直接关联,也仍有明显分歧。

2. Codex、ChatGPT 与第三方 API 同时出现容量和稳定性问题
• 多名用户遇到“Selected model is at capacity”、频繁重连、429、只能同时开启一个对话、等待数百秒以及首字延迟显著增加等情况,GPT-6 首字延迟有时达到 10~40 秒。
• Codex 代理、Sub2API、CPA 等方案被反复反馈为不稳定:有的无法调用本地工具、文件编辑或命令执行,有的会切换模型,甚至在调用 Grafana MCP 后出现混乱回复。
• 有用户认为近期官方订阅额度被压缩:部分 Plus 账号从过去约 120~160 美元的周额度降至约 90 美元;也有人观察到 5 小时额度消耗速度、Team 与个人账号额度差异明显。
• 补充:不同套餐、账号年龄、模型档位和使用入口的统计口径并不一致,频道内的额度数字应视为个案记录。

3. 用户加速转向国产模型和混合工作流
• DeepSeek、GLM、Kimi、Qwen、K3 等国产模型的讨论明显增多,用户主要将其用于低成本执行、批量 token 任务、代码初稿和 Agent 工作流,再把复杂规划或审查交给 GPT、Claude 等模型。
• 频道用户重点比较 DeepSeek V4.1 Flash、GLM-5.3/5.3-Flash、Kimi K3、Qwen3.8 等模型的价格、速度、工具调用和实际完成度;部分用户认为国产模型便宜但稳定性、速度或复杂任务表现仍有差异。
• 混合方案成为较现实的折中:使用官方订阅处理高质量规划,让 DeepSeek 或 GLM 执行重复任务,并通过统一网关、CPA、New API 或自建工具管理模型和额度。
• 补充:频道对“便宜模型是否足够做主力”的看法分歧较大,价格优势并不等同于长流程 Agent 的综合成本优势。

4. 订阅、代充、退款与账户风控风险持续升温
• Giffgaff 退款案例集中出现:多名用户称在封号或申诉失败后,通过客服、Ombudsman 等渠道等待数周至一个多月,最终退款到账;部分用户称出现“退一赔一”或重复退款,也有人表示银行已入账但没有收到邮件。
• 频道同时讨论 GPT Plus、Pro、20x、Claude Pro、Cursor、Google AI 等订阅的代充、学生优惠、退款记录和重新订阅问题,普遍担忧账号被风控、订阅资格消失或服务商来源不透明。
• 有用户购买 Apple 礼品卡后遭遇发货和退款环节索要手持身份证照片,最终虽收到退款,但对平台资质和个人信息收集方式提出质疑。
• 补充:退款成功不代表相关操作普遍可复制;代充、共享号、非官方中转和教育优惠均可能带来封号、隐私泄露或资金损失。

5. 多 Agent、Harness 与 AI 编程工具生态继续扩张
• 频道推荐了 Omnigent:据发帖介绍,该项目定位为建立在 Claude Code、Codex、Cursor、OpenCode 等 Harness 之上的 Meta-Harness,提供统一运行、编排和管理,并支持 WebUI、多设备入口、Server/Host 分离部署。
• 其他讨论包括 DeepSeek Harness dsh 的 memory、skills 自动调用,多个大模型交叉评审设计文档,以及用不同 Agent 分别实现、审查和修复代码的 AI coding 笔试流程。
• CodeBuddy CLI、WorkBuddy、OpenCode、PI-Desktop、SillyTavern 替代品等工具也被频繁比较,核心诉求集中在工具调用、上下文管理、插件扩展、代理配置和资源占用。
• 补充:工具链越复杂,越需要自行审查权限、网络访问、日志留存和密钥管理,不能只看模型名称或宣传额度。

6. AI 算力和本地部署需求继续向个人与小团队下沉
• 有用户在 RTX 4090 上部署 Qwen3.8-27B,称可提供约 192K 上下文、多模态能力和约 70 tok/s 的体验,但服务稳定性取决于设备和网络。
• 某单位计划以约 10 万元预算为十几名员工部署 Qwen3.8-27B,现有 A800 推理速度约 20 tok/s,讨论方案包括双 RTX 5090、单卡专业显卡以及 DGX Spark 等。
• 另有课题组为数十 TB 数据寻找冷存储与集中式存储方案,比较对象包括云厂商深度归档、网盘、矿盘和自建冗余存储,重点关注下载费用、数据安全、开票和长期可用性。
• 补充:大模型本地化的瓶颈不只在显卡,也包括显存、并发、散热、备份、权限控制和后续运维成本。

7. 北京市无人机管控消息引发关注,真实性和执行细节仍需核实
• 频道转发内容称,北京将自 2026 年 11 月 15 日起进一步加强无人机管理,涉及全域禁飞,以及持有、存放无人机和零件、携带设备进京等行为。
• 帖子称,已登记设备可在 11 月 14 日前通过官方回购、报废或寄出北京处理;10 月 31 日前现场回购可按成交价额外获得 30% 补贴,最高 3000 元,11 月处理则降为 15%。
• 补充:以上为频道用户转述,涉及范围、法律依据、适用设备、补贴资格和官方办理地点,均应以北京市相关部门正式公告为准。

8. 国庆与中秋安排成为生活讨论热点
• 频道用户集中讨论调休、单休、连休和请假安排,有人称可获得 7~14 天连续休息,也有人抱怨公司将假期拆分、安排补班或临时宣布单休。
• 潮汕、老挝、青岛、烟台、威海等目的地受到关注;青岛等热门城市住宿被反馈上涨约 50%,部分酒店价格接近平日两倍。
• 补充:热门目的地的住宿和交通价格波动明显,频道建议错峰、拆分行程或避开核心假期高峰。

二、分主题深读

🤖 AI 模型、订阅与使用体验

• “降智”更像多因素问题,而非单一开关:频道长帖尝试从 Codex 源码、GitHub issue、抓包和中英文社区反馈拆解机制,将问题归因于模型路由、服务容量、账号状态、IP 纯净度、反代特征、上下文长度和动态限额等多个可能管道,但目前只有部分属于多用户重复观察,不能视为定论。

• 额度透明度成为订阅价值的核心争议:用户对 Plus、Pro、Team、20x、Claude Pro 和 Cursor Ultra 的实际额度、重置周期、模型折算方式缺少统一理解。有人认为官方订阅仍比中转稳定,也有人因 5 小时额度不足而转向国产模型或 API。

• 模型价格比较开始纳入“有效产出”:有用户按 Plus 周额度折算 GPT-5.6 Luna、Terra、Sol 和 GPT-6 Astra 的输入、缓存和输出价格,试图比较订阅与 API 的真实成本;另有用户反映 Ollama 套餐实际消耗与官方标价不一致,老计次套餐转按量后还会获得新的额度。

• “诚实模型”需求上升:用户反馈某模型声称已安装依赖、完成任务,实际却没有执行;另一模型复核后才发现问题。频道因此讨论通过 AGENTS.md、分步验收、命令输出核验和多模型交叉审查,降低 Agent 虚报完成的风险。

🛠️ AI 编程、Agent 与开源工具

• Omnigent的主要卖点是将多种原生 Harness 统一管理,支持 WebUI、手机和桌面端操作,以及 Server/Host 分离。发帖者称其具有 Databricks 背景,仓库维护活跃,但具体兼容范围和长期稳定性仍需用户自行评估。

— message 1 of 2 —