📡 Linux.do 频道日报 · 晚报
有效消息 396 条
📡 Linux.do 频道日报 · 2026-08-27
多源综合 · 已去重整理
一、今日要闻
1. Codex、GPT 额度与服务状态成为频道最大焦点
• 多名用户反馈 GPT-5.6、Codex 今日出现响应缓慢、频繁 429、重连、登录失效、会话提示重新登录,以及长时间读取代码却不执行等问题。
• 多条消息提到 Tibo 在社交平台暗示“明天”可能再次按下重置键,社区因此集中讨论五小时额度、周额度和模型质量是否会恢复。
• 有用户称 GPT-5.6-sol 的网页端思考时长明显缩短,过去可持续十几分钟的任务,如今数分钟内便结束;也有人观察到回答前后像不同能力档位拼接。
• 这些内容主要是用户实测和截图反馈,尚未形成官方公告层面的统一结论。
2. “Luna Reserve”被确认是额度耗尽后的备用通道
• Tibo 相关消息称,Codex 存在独立的 Luna Reserve 用量;当主要额度达到限制后,仍可能继续使用 Luna 系列模型。
• 有用户实际观察到,GPT Plus 五小时限额用完后,界面仍可调用 Luna Max,推测该额度与主额度分开计算。
• 频道同时出现 Plus、Pro、Team、20x 等不同订阅档位的额度差异讨论,部分用户发现同一订阅类型的账号额度并不完全一致,可能与区域、账号状态、模型档位及实际计费方式有关。
3. 国产模型价格战继续,GLM-5.3-Flash 与 Qwen3.8-Flash 正面竞争
• 频道多次讨论 GLM-5.3-Flash、Qwen3.8-Flash-Next 的 API 价格变化。有消息称 Qwen3.8-Flash 当日快速降价,价格已低于 GLM-5.3-Flash,具体数值因渠道和计费口径不同而存在差异。
• GLM-5.3-Flash 的第三方别名“Ox Alpha”被多个渠道采用,用户认为部分中转渠道的实际体验明显好于官方 API,但这一判断仍属于社区实测,不能直接视为模型版本或能力完全一致。
• 有用户按每天 1 亿 Token、输入占 90%、其中 95% 命中缓存、输出占 10% 的条件估算,GLM-5.3-Flash 某些低倍率渠道的日成本约为 25 元左右。
• 讨论显示,单纯比较官方 API 单价并不能代表 Coding Plan 的实际性价比,订阅额度、缓存命中、工具调用和限速策略都会显著影响最终成本。
4. GLM 与 Qwen 新模型开始进入本地部署和真实项目评测
• 频道用户正在尝试部署 GLM-5.3-Flash 与 Qwen3.8-Flash-Next,关注点包括原生上下文长度、显存占用、量化格式、sglang 兼容性以及本地版本与官方 API 的能力差异。
• 有讨论称 GLM-5.3-Flash 具备约 1M 上下文,模型规模较大;Qwen3.8 系列则以较快速度和较低成本受到关注。
• 一份 Unity C# 皮肤系统需求横向评测记录了多个模型在代码生成任务中的耗时与完成效果,测试覆盖 Composer、Grok、Step、Mimo、豆包、Qwen、Claude、GLM、DeepSeek 等模型。
• 另一组前端评测以“鹈鹕骑自行车”的 HTML、SVG、2D 动画和可玩网页为样例,认为 GLM-5.3-Flash 的前端生成效果有惊喜,但免费或低价渠道的响应速度差异很大。
5. AI 编程工具的“模型能力”与“工作台体验”争议升温
• 用户围绕 Codex、Claude Code、DeepSeek Harness、Pi、WorkBuddy、OpenCode、Cursor、Antigravity、Cline 等工具展开比较,评价维度集中在代码质量、工具调用、文件操作、上下文管理、速度、美观程度和稳定性。
• 有用户认为 Codex 在自家模型上也可能存在 harness 层面的体验损耗,例如前端实现质量下降、审美执行偏离、上下文遗失和工具调用不稳定。
• Claude Desktop 被认为界面和使用体验较好,但对非 Claude 命名模型及网关接入限制较多;ChatGPT 模型能力被认可,但桌面端和 VS Code 插件被批评存在隐藏 Bug、登录问题和操作体验不稳定。
• DeepSeek Harness 的用户正在通过开源插件补齐文件树、Git 暂存与提交、Diff、分支管理、多标签终端、代码编辑和图片预览等能力,使其更接近完整 IDE。
6. 中转站、反代与账号池的稳定性和透明度成为持续风险点
• 频道集中讨论低倍率中转、Plus 或 Pro 号池、反代 API、New API、CPA、CC-Switch 以及订阅账号转 API 的真实成本。
• 用户反馈,同一模型在官方端点和经过 New API 或中转后,可能出现工具调用、速度、缓存命中、上下文处理和输出质量差异,原因可能涉及协议转换、请求头、系统提示词、缓存策略、账号池调度和并发限制。
• 有实测称 OpenCode 通过反代调用 DeepSeek-V4-Flash 时,数百万 Token 未命中缓存并产生较高费用;Claude Code 也出现缓存命中率异常降低的反馈。
• 另有用户在 CPA 反代 Claude、Codex CLI 和其他 harness 组合中遇到重连与封号争议。频道内多次提醒,账号共享、代充、反代和来历不明的公益站可能带来封号、退款失败、数据泄露和密钥泄露风险。
7. Chrome 扩展发布额度出现收紧信号
• 用户反馈 Chrome Web Store 开发者后台显示,已发布 11 个扩展后当前上限也为 11 个。
• Google 官方文档称,达到上限后可以申请提高额度,但会根据扩展质量和开发者账号历史进行审核,申请不一定获批。
• 对批量发布扩展的开发者而言,后续需要关注账号合规记录、扩展质量、重复功能和发布节奏,避免额度成为上线瓶颈。
8. 硬件成本上涨与二手设备交易风险并存
• 有机构消息称三星电机已上调第四季度 MLCC 报价,涨幅最高可能达到 30%,但该信息在频道内主要以图片和转述形式流传,仍需等待供应链或厂商进一步确认。
• 多名用户感受到笔记本电脑价格上涨,游戏本高配型号报价达到两三万元,开始关注 2027 年初是否会出现价格回落。
• 二手 Mac 交易出现典型监管锁纠纷:用户线下购买 MacBook Air,外观、账号和配置检查均正常,但恢复系统并登录个人账号后发现设备存在监管锁,卖家随后失联。
• 频道还出现 Mac M1 24GB 内存、1TB 存储设备的二手转让,以及新款 MacBook Air 用户咨询 AI 软件和视频模型运行能力。
二、分主题深读
🤖 AI 模型、价格与质量
• 模型体验分化明显:GLM-5.3-Flash 在代码、前端和部分复杂任务中获得较多正面反馈,但也有用户认为其存在丢指令、理解不完整等问题。GLM-5.3-F 与 GLM-5.3-Flash 的名称和渠道版本容易混淆,实际使用前应确认模型 ID、上下文、计费倍率和供应方。
• Qwen3.8-Flash 受到低价关注:频道称其价格快速下调,部分用户认为这是面对竞争的主动应对。Qwen3.8-Flash-Next 的本地 Q4 量化版本也开始被测试,但生成复杂 SVG 动画时,效果评价差异较大。
• DeepSeek 仍是成本参照物:随着部分 Coding Plan 和 API 价格上涨,用户开始寻找便宜、量大、速度快的替代渠道,包括 OpenCode Go、Ollama Cloud、模型中转和按量 API。部分用户转向 Ollama Cloud Pro,原因是 DeepSeek-V4-Flash 在其他线路上的速度难以接受。
• 模型输出风格引发讨论:有人发现 Ollama 中的 DeepSeek-V4-Flash 偶尔输出文言文;也有人认为 AI 生成内容反复进入训练数据后,可能导致语言趋同、黑话增多、细节减少和“模型坍缩”式体验。这类讨论更偏现象观察,不能据此证明具体模型已经发生训练层面的坍缩。
🧰 Coding Agent 与开发工作流
• Effort 档位需要结合任务和额度:针对 Claude Code 使用 GLM-5.3-Flash 的讨论认为,High 与 Max 的差异不只体现在能力,也体现在 Token 消耗、限速和订阅额度下降速度。中型功能、单点修复和代码理解任务,社区正在权衡 High 的成本与 Max 的稳定性。
— message 1 of 2 —
有效消息 396 条
📡 Linux.do 频道日报 · 2026-08-27
多源综合 · 已去重整理
今日主线:频道讨论高度集中在 AI 编程工具的额度、限速、模型质量与中转稳定性,Codex、GPT、Claude、GLM、Qwen、DeepSeek 等服务同时出现“重置、降速、降智、缓存失效、登录异常”等反馈。与此同时,国产模型价格竞争和本地部署热度继续升温,围绕 GLM-5.3-Flash、Qwen3.8-Flash 系列的实测、API 价格与 Coding Plan 选择成为另一条主线。
一、今日要闻
1. Codex、GPT 额度与服务状态成为频道最大焦点
• 多名用户反馈 GPT-5.6、Codex 今日出现响应缓慢、频繁 429、重连、登录失效、会话提示重新登录,以及长时间读取代码却不执行等问题。
• 多条消息提到 Tibo 在社交平台暗示“明天”可能再次按下重置键,社区因此集中讨论五小时额度、周额度和模型质量是否会恢复。
• 有用户称 GPT-5.6-sol 的网页端思考时长明显缩短,过去可持续十几分钟的任务,如今数分钟内便结束;也有人观察到回答前后像不同能力档位拼接。
• 这些内容主要是用户实测和截图反馈,尚未形成官方公告层面的统一结论。
2. “Luna Reserve”被确认是额度耗尽后的备用通道
• Tibo 相关消息称,Codex 存在独立的 Luna Reserve 用量;当主要额度达到限制后,仍可能继续使用 Luna 系列模型。
• 有用户实际观察到,GPT Plus 五小时限额用完后,界面仍可调用 Luna Max,推测该额度与主额度分开计算。
• 频道同时出现 Plus、Pro、Team、20x 等不同订阅档位的额度差异讨论,部分用户发现同一订阅类型的账号额度并不完全一致,可能与区域、账号状态、模型档位及实际计费方式有关。
3. 国产模型价格战继续,GLM-5.3-Flash 与 Qwen3.8-Flash 正面竞争
• 频道多次讨论 GLM-5.3-Flash、Qwen3.8-Flash-Next 的 API 价格变化。有消息称 Qwen3.8-Flash 当日快速降价,价格已低于 GLM-5.3-Flash,具体数值因渠道和计费口径不同而存在差异。
• GLM-5.3-Flash 的第三方别名“Ox Alpha”被多个渠道采用,用户认为部分中转渠道的实际体验明显好于官方 API,但这一判断仍属于社区实测,不能直接视为模型版本或能力完全一致。
• 有用户按每天 1 亿 Token、输入占 90%、其中 95% 命中缓存、输出占 10% 的条件估算,GLM-5.3-Flash 某些低倍率渠道的日成本约为 25 元左右。
• 讨论显示,单纯比较官方 API 单价并不能代表 Coding Plan 的实际性价比,订阅额度、缓存命中、工具调用和限速策略都会显著影响最终成本。
4. GLM 与 Qwen 新模型开始进入本地部署和真实项目评测
• 频道用户正在尝试部署 GLM-5.3-Flash 与 Qwen3.8-Flash-Next,关注点包括原生上下文长度、显存占用、量化格式、sglang 兼容性以及本地版本与官方 API 的能力差异。
• 有讨论称 GLM-5.3-Flash 具备约 1M 上下文,模型规模较大;Qwen3.8 系列则以较快速度和较低成本受到关注。
• 一份 Unity C# 皮肤系统需求横向评测记录了多个模型在代码生成任务中的耗时与完成效果,测试覆盖 Composer、Grok、Step、Mimo、豆包、Qwen、Claude、GLM、DeepSeek 等模型。
• 另一组前端评测以“鹈鹕骑自行车”的 HTML、SVG、2D 动画和可玩网页为样例,认为 GLM-5.3-Flash 的前端生成效果有惊喜,但免费或低价渠道的响应速度差异很大。
5. AI 编程工具的“模型能力”与“工作台体验”争议升温
• 用户围绕 Codex、Claude Code、DeepSeek Harness、Pi、WorkBuddy、OpenCode、Cursor、Antigravity、Cline 等工具展开比较,评价维度集中在代码质量、工具调用、文件操作、上下文管理、速度、美观程度和稳定性。
• 有用户认为 Codex 在自家模型上也可能存在 harness 层面的体验损耗,例如前端实现质量下降、审美执行偏离、上下文遗失和工具调用不稳定。
• Claude Desktop 被认为界面和使用体验较好,但对非 Claude 命名模型及网关接入限制较多;ChatGPT 模型能力被认可,但桌面端和 VS Code 插件被批评存在隐藏 Bug、登录问题和操作体验不稳定。
• DeepSeek Harness 的用户正在通过开源插件补齐文件树、Git 暂存与提交、Diff、分支管理、多标签终端、代码编辑和图片预览等能力,使其更接近完整 IDE。
6. 中转站、反代与账号池的稳定性和透明度成为持续风险点
• 频道集中讨论低倍率中转、Plus 或 Pro 号池、反代 API、New API、CPA、CC-Switch 以及订阅账号转 API 的真实成本。
• 用户反馈,同一模型在官方端点和经过 New API 或中转后,可能出现工具调用、速度、缓存命中、上下文处理和输出质量差异,原因可能涉及协议转换、请求头、系统提示词、缓存策略、账号池调度和并发限制。
• 有实测称 OpenCode 通过反代调用 DeepSeek-V4-Flash 时,数百万 Token 未命中缓存并产生较高费用;Claude Code 也出现缓存命中率异常降低的反馈。
• 另有用户在 CPA 反代 Claude、Codex CLI 和其他 harness 组合中遇到重连与封号争议。频道内多次提醒,账号共享、代充、反代和来历不明的公益站可能带来封号、退款失败、数据泄露和密钥泄露风险。
7. Chrome 扩展发布额度出现收紧信号
• 用户反馈 Chrome Web Store 开发者后台显示,已发布 11 个扩展后当前上限也为 11 个。
• Google 官方文档称,达到上限后可以申请提高额度,但会根据扩展质量和开发者账号历史进行审核,申请不一定获批。
• 对批量发布扩展的开发者而言,后续需要关注账号合规记录、扩展质量、重复功能和发布节奏,避免额度成为上线瓶颈。
8. 硬件成本上涨与二手设备交易风险并存
• 有机构消息称三星电机已上调第四季度 MLCC 报价,涨幅最高可能达到 30%,但该信息在频道内主要以图片和转述形式流传,仍需等待供应链或厂商进一步确认。
• 多名用户感受到笔记本电脑价格上涨,游戏本高配型号报价达到两三万元,开始关注 2027 年初是否会出现价格回落。
• 二手 Mac 交易出现典型监管锁纠纷:用户线下购买 MacBook Air,外观、账号和配置检查均正常,但恢复系统并登录个人账号后发现设备存在监管锁,卖家随后失联。
• 频道还出现 Mac M1 24GB 内存、1TB 存储设备的二手转让,以及新款 MacBook Air 用户咨询 AI 软件和视频模型运行能力。
二、分主题深读
🤖 AI 模型、价格与质量
• 模型体验分化明显:GLM-5.3-Flash 在代码、前端和部分复杂任务中获得较多正面反馈,但也有用户认为其存在丢指令、理解不完整等问题。GLM-5.3-F 与 GLM-5.3-Flash 的名称和渠道版本容易混淆,实际使用前应确认模型 ID、上下文、计费倍率和供应方。
• Qwen3.8-Flash 受到低价关注:频道称其价格快速下调,部分用户认为这是面对竞争的主动应对。Qwen3.8-Flash-Next 的本地 Q4 量化版本也开始被测试,但生成复杂 SVG 动画时,效果评价差异较大。
• DeepSeek 仍是成本参照物:随着部分 Coding Plan 和 API 价格上涨,用户开始寻找便宜、量大、速度快的替代渠道,包括 OpenCode Go、Ollama Cloud、模型中转和按量 API。部分用户转向 Ollama Cloud Pro,原因是 DeepSeek-V4-Flash 在其他线路上的速度难以接受。
• 模型输出风格引发讨论:有人发现 Ollama 中的 DeepSeek-V4-Flash 偶尔输出文言文;也有人认为 AI 生成内容反复进入训练数据后,可能导致语言趋同、黑话增多、细节减少和“模型坍缩”式体验。这类讨论更偏现象观察,不能据此证明具体模型已经发生训练层面的坍缩。
🧰 Coding Agent 与开发工作流
• Effort 档位需要结合任务和额度:针对 Claude Code 使用 GLM-5.3-Flash 的讨论认为,High 与 Max 的差异不只体现在能力,也体现在 Token 消耗、限速和订阅额度下降速度。中型功能、单点修复和代码理解任务,社区正在权衡 High 的成本与 Max 的稳定性。
— message 1 of 2 —