📡 Linux.do 频道日报 · 夜报
有效消息 194 条
📡 Linux.do 频道日报 · 2026-08-26
多源综合 · 已去重整理
一、今日要闻
1. Ox Alpha 身份揭晓:智谱确认其为 GLM 系列新版本
• 多名用户转述彭博及智谱相关消息称,OpenRouter 上近期以匿名方式开放、调用量快速登顶的 Ox Alpha,已被确认是智谱 GLM 系列的新版本。
• 社区此前通过分词器指纹、API 行为和视频编码器特征推测其与 GLM-5.3-Flash 高度相关;消息称该模型权重将于当晚发布。
• OpenRouter 页面一度显示 Ox Alpha 将于 8 月 26 日下线,用户实际使用中也出现 429 或模型不可选。
影响:免费匿名预览窗口结束后,开发者将转向关注开源权重、正式价格、并发限制及实际可用算力。
2. Qwen3.8-Flash-Next 正式发布并开放权重
• 频道消息显示,Qwen3.8-Flash-Next 已提前于晚间开放,官方宣传其对标甚至超越 Claude Opus 4.6 Max 的部分能力。
• 用户转述的模型规格为总参数约 176B、每 token 激活约 6B;另有“125B 主体加 51B N-gram 嵌入表”的说法,仍待以官方技术报告为准。
• 定价信息为每百万 Token 输入 1 元、输出 3 元。社区期待其保留低价试用期,并关注 coding 场景的实际稳定性。
影响:国产 Flash 级模型的能力和价格竞争加速,低成本 API、私有部署与编程代理的选择空间扩大。
3. Codex 更新引发 WSL、MCP 与 Windows 桌面端故障集中反馈
• 多名用户警告暂缓升级 Codex 26.82x,主要问题包括 WSL 下 MCP 通信故障、桌面端无法发送消息、目标任务中断,以及配置报错。
• 有案例显示 ChatGPT/Codex Desktop 在恢复 WSL 托管线程时提示
• 还有用户遇到客户端更新后只会“聊天”、输入 token 超限无法通过换对话解决、1M 上下文被压至 200K 且配置失效等问题。
为何重要:此类问题直接影响本地开发和长任务连续性,升级前应备份
4. Codex 订阅额度争议升温:Fast 子代理、重置周期与模型路由均被质疑
• 用户发现脚本任务中可能存在未预期的 Fast 模式子智能体消耗,造成额度下降明显快于预期。
• 多位 Pro/20x 用户反馈:重置后的首周耐用度与后续周期差异显著;Goal 任务在额度耗尽后会直接中断,代码或方案处于未完成状态。
• 部分用户认为 Sol 高档位效果较好但消耗过快,Luna 相对耐用却在复杂任务、数据计算和执行一致性上表现不佳。
共识:订阅页的总额度并不等于稳定可用的工程产能;任务拆分、模型分层和消耗审计正成为高频使用者的刚需。
5. GPT 网页端被路由至 5.5-mini 被官方承认为 Bug
• 频道转述称,部分用户此前在 GPT Web 上即使选择思考模型,仍被路由到 GPT-5.5-mini,官方已承认该现象为 Bug。
• 个别土区订阅用户反馈,在 App Store 扣费完成后能力恢复;但这只是个案,不足以证明付款或地区设置是修复条件。
影响:模型名、实际路由和最终输出能力可能不一致,关键任务应通过输出质量、日志或可见模型标识做交叉确认。
6. 账号风控与订阅支付问题覆盖 OpenAI、Anthropic、Google
• 有用户反馈闲鱼上出售 Codex 邀请的商家被封、二人共享 Pro 20x 账号遭封、sub2api 分发频繁触发 429 或重新授权。
• Google AI Studio 多开 API Key 后出现账号反复验证与封控;Anthropic、Claude Max 和 GPT 各类跨区支付中,KYC、礼品卡、虚拟卡及地区货币锁定问题仍多发。
• YouTube Premium 也出现同一时间仅允许一台设备播放的提示。
风险提示:共享、分发、异常高频 Key 创建、跨区支付与规避限制的操作均可能触发平台风控,短期成本优势可能转化为账号与数据损失。
7. MiniMax 上半年收入 1.17 亿美元,企业服务成为主引擎
• 转述财报信息显示,MiniMax 上半年收入 1.17 亿美元,同比增长 283.1%,已超过其 2025 年全年 7900 万美元收入规模。
• 开放平台及其他 AI 企业服务收入 7393 万美元,同比增 703.1%,占比 63.4%;AI 原生产品收入为 4264 万美元,同比增长 100.9%。
为何重要:收入重心从消费者产品向 API 与企业服务倾斜,说明模型公司正在寻求更可持续的商业化结构。
8. 算力用电成为新增负荷核心,基础设施约束更受关注
• 据频道转述的央视财经数据,7 月全国全社会用电量再破 1 万亿千瓦时,互联网数据服务用电量同比增长 40%。
• 江苏 106 家算力中心企业 7 月用电量超过 13 亿千瓦时、同比增长 31%;常熟智算产业最高负荷达 20 万千瓦,占全市约 4.1%。
• 冀北电网一次百兆瓦级算电协同调节中,11 座算力中心在不到 10 分钟释放 100.64MW 供电空间。
影响:模型价格、供给和区域布局不只取决于芯片,电力调度、机房建设和能源成本也会成为决定因素。
二、分主题深读
🤖 AI 与算力
• GLM-5.3-Flash 的供给与限制:Ox Alpha 的高热度验证了用户对低价高性能 coding 模型的需求,但智谱官方 Coding Plan 被反馈 5.3 并发仅 1、额度消耗偏快。模型能力、并发和可得算力之间仍存在明显落差。
• 本地模型实践:有用户在 Mac Studio M1 Ultra 上以 oMLX 运行 Qwen3.8-27B,调试后可达到约 30 token/s;但启用 MTP 后工具调用错误和循环问题增加,选择降低或关闭 MTP 以换取可靠性。
• 华为海外算力投标:频道转述称华为向埃及政府 AI 数据中心项目投标,方案包括至少 1408 颗昇腾 950 用于训练、另 600 颗用于推理集群,并提出 12 个月建设周期。若落地,可能成为昇腾加速器公开确认的海外基础设施案例。
• 模型能力不能只看榜单:Ox Alpha 被用户指出会因环境变量等基础错误卡住长时间;另有对 GPT、Luna、Claude 的反馈集中在“能输出但不解决问题”、方案冗长和代码返工。这类工程可用性仍需要真实任务评测。
🧑💻 编程工具与开发工作流
• Spec-driven 工作流讨论:用户比较了 Superpowers 的强约束式 spec/plan 与偏 PRD 化的 to-spec、to-ticket 流程。前者在文件、代码和测试预期上更可控,后者给模型更多发挥空间,却更容易偏离实现意图。
• AI 代码质量治理:针对“AI 屎山”,社区共识倾向于在需求阶段明确边界、拆小任务、维护项目约束,并为快速交付后的重构预留时间。单纯累加
• 索引滥用问题:有开发者观察到 AI 设计数据库时倾向于大量创建唯一、联合索引。应要求模型提供查询模式、数据规模、写入成本与执行计划依据,不能把索引作为默认优化手段。
• 桌面 GUI 自动测试缺口:Web 端可借助 browser-use 等工具,但桌面程序仍多依赖截图与模拟点击,成本高且不稳定。需求集中在可脚本化的 UI 自动化、可观测日志和可复现测试环境。
— message 1 of 2 —
有效消息 194 条
📡 Linux.do 频道日报 · 2026-08-26
多源综合 · 已去重整理
今日主线:频道讨论被两场模型发布与一轮 Codex 故障潮占据。智谱确认匿名模型 Ox Alpha 属于 GLM 新版本并拟开放权重,Qwen3.8-Flash-Next 也正式推出;与此同时,订阅额度、客户端更新、路由降级和账号风控,成为开发者使用 AI 工具时最集中的现实摩擦。
一、今日要闻
1. Ox Alpha 身份揭晓:智谱确认其为 GLM 系列新版本
• 多名用户转述彭博及智谱相关消息称,OpenRouter 上近期以匿名方式开放、调用量快速登顶的 Ox Alpha,已被确认是智谱 GLM 系列的新版本。
• 社区此前通过分词器指纹、API 行为和视频编码器特征推测其与 GLM-5.3-Flash 高度相关;消息称该模型权重将于当晚发布。
• OpenRouter 页面一度显示 Ox Alpha 将于 8 月 26 日下线,用户实际使用中也出现 429 或模型不可选。
影响:免费匿名预览窗口结束后,开发者将转向关注开源权重、正式价格、并发限制及实际可用算力。
2. Qwen3.8-Flash-Next 正式发布并开放权重
• 频道消息显示,Qwen3.8-Flash-Next 已提前于晚间开放,官方宣传其对标甚至超越 Claude Opus 4.6 Max 的部分能力。
• 用户转述的模型规格为总参数约 176B、每 token 激活约 6B;另有“125B 主体加 51B N-gram 嵌入表”的说法,仍待以官方技术报告为准。
• 定价信息为每百万 Token 输入 1 元、输出 3 元。社区期待其保留低价试用期,并关注 coding 场景的实际稳定性。
影响:国产 Flash 级模型的能力和价格竞争加速,低成本 API、私有部署与编程代理的选择空间扩大。
3. Codex 更新引发 WSL、MCP 与 Windows 桌面端故障集中反馈
• 多名用户警告暂缓升级 Codex 26.82x,主要问题包括 WSL 下 MCP 通信故障、桌面端无法发送消息、目标任务中断,以及配置报错。
• 有案例显示 ChatGPT/Codex Desktop 在恢复 WSL 托管线程时提示
invalid transport in mcp_servers.codex_app;另一案例称 26.820.60940 出现 Windows 设置未完成,修改 sandbox 为 unelevated 后暂时恢复。• 还有用户遇到客户端更新后只会“聊天”、输入 token 超限无法通过换对话解决、1M 上下文被压至 200K 且配置失效等问题。
为何重要:此类问题直接影响本地开发和长任务连续性,升级前应备份
config.toml、锁定可用版本,并先在非关键项目验证。4. Codex 订阅额度争议升温:Fast 子代理、重置周期与模型路由均被质疑
• 用户发现脚本任务中可能存在未预期的 Fast 模式子智能体消耗,造成额度下降明显快于预期。
• 多位 Pro/20x 用户反馈:重置后的首周耐用度与后续周期差异显著;Goal 任务在额度耗尽后会直接中断,代码或方案处于未完成状态。
• 部分用户认为 Sol 高档位效果较好但消耗过快,Luna 相对耐用却在复杂任务、数据计算和执行一致性上表现不佳。
共识:订阅页的总额度并不等于稳定可用的工程产能;任务拆分、模型分层和消耗审计正成为高频使用者的刚需。
5. GPT 网页端被路由至 5.5-mini 被官方承认为 Bug
• 频道转述称,部分用户此前在 GPT Web 上即使选择思考模型,仍被路由到 GPT-5.5-mini,官方已承认该现象为 Bug。
• 个别土区订阅用户反馈,在 App Store 扣费完成后能力恢复;但这只是个案,不足以证明付款或地区设置是修复条件。
影响:模型名、实际路由和最终输出能力可能不一致,关键任务应通过输出质量、日志或可见模型标识做交叉确认。
6. 账号风控与订阅支付问题覆盖 OpenAI、Anthropic、Google
• 有用户反馈闲鱼上出售 Codex 邀请的商家被封、二人共享 Pro 20x 账号遭封、sub2api 分发频繁触发 429 或重新授权。
• Google AI Studio 多开 API Key 后出现账号反复验证与封控;Anthropic、Claude Max 和 GPT 各类跨区支付中,KYC、礼品卡、虚拟卡及地区货币锁定问题仍多发。
• YouTube Premium 也出现同一时间仅允许一台设备播放的提示。
风险提示:共享、分发、异常高频 Key 创建、跨区支付与规避限制的操作均可能触发平台风控,短期成本优势可能转化为账号与数据损失。
7. MiniMax 上半年收入 1.17 亿美元,企业服务成为主引擎
• 转述财报信息显示,MiniMax 上半年收入 1.17 亿美元,同比增长 283.1%,已超过其 2025 年全年 7900 万美元收入规模。
• 开放平台及其他 AI 企业服务收入 7393 万美元,同比增 703.1%,占比 63.4%;AI 原生产品收入为 4264 万美元,同比增长 100.9%。
为何重要:收入重心从消费者产品向 API 与企业服务倾斜,说明模型公司正在寻求更可持续的商业化结构。
8. 算力用电成为新增负荷核心,基础设施约束更受关注
• 据频道转述的央视财经数据,7 月全国全社会用电量再破 1 万亿千瓦时,互联网数据服务用电量同比增长 40%。
• 江苏 106 家算力中心企业 7 月用电量超过 13 亿千瓦时、同比增长 31%;常熟智算产业最高负荷达 20 万千瓦,占全市约 4.1%。
• 冀北电网一次百兆瓦级算电协同调节中,11 座算力中心在不到 10 分钟释放 100.64MW 供电空间。
影响:模型价格、供给和区域布局不只取决于芯片,电力调度、机房建设和能源成本也会成为决定因素。
二、分主题深读
🤖 AI 与算力
• GLM-5.3-Flash 的供给与限制:Ox Alpha 的高热度验证了用户对低价高性能 coding 模型的需求,但智谱官方 Coding Plan 被反馈 5.3 并发仅 1、额度消耗偏快。模型能力、并发和可得算力之间仍存在明显落差。
• 本地模型实践:有用户在 Mac Studio M1 Ultra 上以 oMLX 运行 Qwen3.8-27B,调试后可达到约 30 token/s;但启用 MTP 后工具调用错误和循环问题增加,选择降低或关闭 MTP 以换取可靠性。
• 华为海外算力投标:频道转述称华为向埃及政府 AI 数据中心项目投标,方案包括至少 1408 颗昇腾 950 用于训练、另 600 颗用于推理集群,并提出 12 个月建设周期。若落地,可能成为昇腾加速器公开确认的海外基础设施案例。
• 模型能力不能只看榜单:Ox Alpha 被用户指出会因环境变量等基础错误卡住长时间;另有对 GPT、Luna、Claude 的反馈集中在“能输出但不解决问题”、方案冗长和代码返工。这类工程可用性仍需要真实任务评测。
🧑💻 编程工具与开发工作流
• Spec-driven 工作流讨论:用户比较了 Superpowers 的强约束式 spec/plan 与偏 PRD 化的 to-spec、to-ticket 流程。前者在文件、代码和测试预期上更可控,后者给模型更多发挥空间,却更容易偏离实现意图。
• AI 代码质量治理:针对“AI 屎山”,社区共识倾向于在需求阶段明确边界、拆小任务、维护项目约束,并为快速交付后的重构预留时间。单纯累加
AGENTS.md 规则,不能替代代码审查、测试和架构约束。• 索引滥用问题:有开发者观察到 AI 设计数据库时倾向于大量创建唯一、联合索引。应要求模型提供查询模式、数据规模、写入成本与执行计划依据,不能把索引作为默认优化手段。
• 桌面 GUI 自动测试缺口:Web 端可借助 browser-use 等工具,但桌面程序仍多依赖截图与模拟点击,成本高且不稳定。需求集中在可脚本化的 UI 自动化、可观测日志和可复现测试环境。
— message 1 of 2 —