📡 Linux.do 频道日报 · 晚报
有效消息 202 条
📡 Linux.do 频道日报 · 2026-08-29
多源综合 · 已去重整理
一、今日要闻
1. Codex / GPT 用量重置频繁,Plus 用户围绕五小时限制集中吐槽
• 多条消息称,ChatGPT Plus 用户的 Codex 与 ChatGPT Work 重新受到滚动五小时用量限制影响,社区当天多次出现“即将重置”“明天重置”以及“刚重置”的提醒。
• 有用户表示,额度恢复与消耗节奏不稳定,短时间集中运行项目、长思考或多智能体任务后,很快触发限制;也有人担心为了赶在重置前使用额度而牺牲休息。
• 频道内还出现 GPT Pro 5x、20x、Team、Plus 以及 iOS 渠道价格与续费方式的比较,核心分歧在于:更高档位是否值得,以及实际可用额度能否覆盖中度研究和开发需求。
• 影响:对于依赖长流程 Vibe Coding 的用户,额度策略已经直接决定工作流设计,拆分任务、控制并发和保留备用模型成为现实需求。
2. 智谱 GLM-5.3 开源并推出大额体验额度,但服务稳定性引发争议
• 频道转述称,智谱于 8 月 28 日晚宣布开放 GLM-5.3 模型权重,定位包括复杂编码、防御性网络安全和长程任务,并支持本地运行与个性化定制。
• Zcode 相关消息称,平台上线 GLM-5.3 后提供限时大额 Token 福利,另有 AutoClaw 新用户积分、登录积分和 GLM-5.3-Flash 使用活动。
• 但福利带来的高并发也被认为可能影响服务稳定性:有用户反馈 Zcode 体验卡难以使用、速度变慢或出现验证页面;另有消息称智谱服务在周末出现卡顿、429 或连接异常。
• 一名用户称,部门通过 CPA 使用智谱 Coding Plan,8 个账号供约 20 人使用后同时被禁用,导致工作受影响;具体封禁原因和解封可能性尚未明确。
• 综合判断:模型权重开放与低门槛额度降低了试用成本,但账号共享、批量调用和活动期间的超大流量可能带来明显的风控与可用性风险。
3. Claude、Codex 与国产模型的“中途停止”问题成为工程讨论焦点
• 有用户在 Codex 中通过 CCS 接入 GLM-5.3、Qwen 3.8 等国产模型时,发现任务执行到阶段性汇报环节便被判定为结束,工具调用无法继续。
• 其尝试在提示词中要求“未完成时必须将进度叙述与下一个工具调用放在同一条响应中”,但同一会话仍出现提前停止,说明问题可能涉及代理层协议、工具调用格式或模型对系统提示的兼容性。
• 另有用户反馈 Codex 5.6 执行 PowerShell 本地组件失败,部分模型能调用、部分模型不能调用,回退到 5.5 后暂时恢复;还有人遇到 Codex 无可用文件读写或命令执行工具、空回复以及任务中断。
• 频道共识:模型能力之外,工具协议适配、消息结束标记、代理实现和客户端版本同样会决定 Agent 是否真正可用。
4. CPA、New API、sub2api 与 Codex 生态持续调整
• 有教程介绍在 New API 套 CPA 的情况下,为 Codex 增加独立 Web Search 能力,关键在于供应商配置中启用
• 发帖者称,原先使用 sub2api 时 Codex 认证、用量记录和 Web Search 之间存在兼容问题,因此改用 New API 与 CPA 组合;但该方案涉及多层转发,配置复杂度和维护成本也随之增加。
• 频道内多次出现“Tibo继续支持 CPA”“CPA再次官方认证可用”的转述,带动用户询问 Luna Reserve、模型切换、缓存命中率与账号池稳定性。
• 同时,sub2api-xray 项目作者称 GitHub 账号和仓库频繁遭遇风控,建议有需要的用户及时保存项目;这也反映出相关工具项目对账号、代理和平台审核高度敏感。
• 注意:中转、共享账号和第三方 API 的可用性变化很快,公开帖中的“官方支持”或“稳定可用”仍应以服务商实际公告和个人测试为准。
5. AI 编程产品的速度、额度与价格矛盾集中爆发
• 用户吐槽 Qoder 与 Token Plan 分开计费,Qoder 自身额度少且运行速度慢;一名用户两天产生约 200 万未缓存输入、超过 2.5 亿缓存输入和约 100 万输出,项目仍未完成,并质疑产品线与模型调用关系。
• Codex 也被指执行缓慢,有用户称十几分钟只修改了一百多行代码;多开 Agent、并行开发和子 Agent 能否提速,成为频道反复讨论的问题。
• Claude Code 则被发现可能命中“Bash-first”策略:在 Auto 模式下优先用 Bash 读取和编辑文件,而不是原生 Read / Write / Edit 工具。发帖者认为这会增加 Token 消耗,并导致速度和完成质量下降。
• 另有用户反馈 Zed 预测功能开始收费,WorkBuddy 的 HY4 使用一下午便返回 429,所谓限免周期与实际额度之间存在落差。
• 共同问题并非单纯“哪个模型最强”,而是单位成本完成任务的效率、上下文消耗、工具调用可靠性以及限额透明度。
6. 硬件与本地模型部署讨论升温:ROCm 10、DGX Spark 与 Qwen 3.8
• 频道转述 AMD 正式发布 ROCm 10,版本号从 ROCm 7.14 跳跃升级;Windows 侧据称将原有独立 HIP SDK 并入与 Linux 统一的 ROCm Core SDK,并加入面向 AI 开发的整合能力。
• 消息还称,ROCm 10 接入 Claude Code、Cursor 等编程工具,并在 8 张 Instinct MI355X 加速卡平台上展示大幅推理性能提升;具体性能数字和测试条件仍需以 AMD 完整资料核验。
• 有用户比较“付费 API”与购买 DGX Spark 的成本,询问两台设备能够运行哪些模型;另有帖子讨论以 170HX 等硬件部署 Qwen 3.8 27B 全精度或 F8 版本。
• NexGPU 宣布重构算力平台,重新整理供应商与实例模板,预装 PyTorch、vLLM、Ollama、ComfyUI、Stable Diffusion、Whisper、LLaMA Factory、Unsloth 等环境,目标是降低 GPU 租用和部署门槛。
• 本地部署的关键仍是显存、带宽、量化精度、并发需求与软件栈兼容性,不能只按模型参数量或宣传性能做购买决定。
7. 多模态应用从“能生成”转向“能定位、能操作”
• 有开发者将基于 Gemini 的视频导航和 PDF 定位功能整合进自己的聊天工具:用户拖入视频后,模型可根据问题定位相关片段;分析 PDF 时则返回相关页码并标注位置。
• Fal.ai 上出现无需登录、每日可生成 5 条视频的 MiniMax H3 Max 体验,单条约 5 秒、分辨率为 768p,主打较快生成速度;用户反馈速度突出,但生成额度显示不透明,且高分辨率仍需其他版本。
• 频道也讨论了视频分镜之间风格一致性不足的问题:单个短片效果尚可,但连续生成漫剧或多镜头内容时,人物和画面风格容易漂移,成本控制同样是实际门槛。
8. 求职诈骗窝点被查,频道转发案例提醒防范“高薪岗位”陷阱
• 据转发消息,中国警方侦破一个通过虚假招聘信息为求职诈骗引流的窝点,刑事拘留 10 人。
• 犯罪嫌疑人利用人力资源中介便利,在智联招聘、BOSS 直聘、抖音、58 同城、小红书等平台发布虚假岗位,声称可以安排国家电网、部队文职、三甲医院等工作。
• 已发现 106 人被骗,涉案金额超过 1000 万元;受害者被引导至线下后,与所谓中介签订“就业合同”,并被分批收取高额介绍费用。
• 求职时凡是承诺“内部安排”“无需考试”“缴费即可入职”的岗位,都应通过官方招聘渠道和用人单位公开联系方式交叉核验。
二、分主题深读
🤖 AI 模型、额度与订阅
• 模型选择从“能力排行”转向“任务经济学”:频道围绕 GPT、Claude、Gemini、Grok、GLM、Qwen、DeepSeek、豆包、Kimi 等模型展开比较。用户普遍承认国产模型进步明显,但在复杂推理、长文本稳定性和创意一致性方面,仍会在关键任务中切回高价海外模型。
• Qwen 3.8 Max 被指思考时间过长:有 Standard 用户反馈,一次思考接近 40 分钟,消耗约 13% 周配额;如果用于真实开发任务,可能出现“额度已消耗大半、需求仍未完成”的情况。
— message 1 of 2 —
有效消息 202 条
📡 Linux.do 频道日报 · 2026-08-29
多源综合 · 已去重整理
今日一句话:频道主线高度集中于 AI 编程工具的额度、重置、速度与渠道稳定性,Codex、Claude、智谱和国产模型轮番成为讨论中心;与此同时,开源部署、GPU 算力、支付风控、账号安全与海外服务使用问题持续升温。
一、今日要闻
1. Codex / GPT 用量重置频繁,Plus 用户围绕五小时限制集中吐槽
• 多条消息称,ChatGPT Plus 用户的 Codex 与 ChatGPT Work 重新受到滚动五小时用量限制影响,社区当天多次出现“即将重置”“明天重置”以及“刚重置”的提醒。
• 有用户表示,额度恢复与消耗节奏不稳定,短时间集中运行项目、长思考或多智能体任务后,很快触发限制;也有人担心为了赶在重置前使用额度而牺牲休息。
• 频道内还出现 GPT Pro 5x、20x、Team、Plus 以及 iOS 渠道价格与续费方式的比较,核心分歧在于:更高档位是否值得,以及实际可用额度能否覆盖中度研究和开发需求。
• 影响:对于依赖长流程 Vibe Coding 的用户,额度策略已经直接决定工作流设计,拆分任务、控制并发和保留备用模型成为现实需求。
2. 智谱 GLM-5.3 开源并推出大额体验额度,但服务稳定性引发争议
• 频道转述称,智谱于 8 月 28 日晚宣布开放 GLM-5.3 模型权重,定位包括复杂编码、防御性网络安全和长程任务,并支持本地运行与个性化定制。
• Zcode 相关消息称,平台上线 GLM-5.3 后提供限时大额 Token 福利,另有 AutoClaw 新用户积分、登录积分和 GLM-5.3-Flash 使用活动。
• 但福利带来的高并发也被认为可能影响服务稳定性:有用户反馈 Zcode 体验卡难以使用、速度变慢或出现验证页面;另有消息称智谱服务在周末出现卡顿、429 或连接异常。
• 一名用户称,部门通过 CPA 使用智谱 Coding Plan,8 个账号供约 20 人使用后同时被禁用,导致工作受影响;具体封禁原因和解封可能性尚未明确。
• 综合判断:模型权重开放与低门槛额度降低了试用成本,但账号共享、批量调用和活动期间的超大流量可能带来明显的风控与可用性风险。
3. Claude、Codex 与国产模型的“中途停止”问题成为工程讨论焦点
• 有用户在 Codex 中通过 CCS 接入 GLM-5.3、Qwen 3.8 等国产模型时,发现任务执行到阶段性汇报环节便被判定为结束,工具调用无法继续。
• 其尝试在提示词中要求“未完成时必须将进度叙述与下一个工具调用放在同一条响应中”,但同一会话仍出现提前停止,说明问题可能涉及代理层协议、工具调用格式或模型对系统提示的兼容性。
• 另有用户反馈 Codex 5.6 执行 PowerShell 本地组件失败,部分模型能调用、部分模型不能调用,回退到 5.5 后暂时恢复;还有人遇到 Codex 无可用文件读写或命令执行工具、空回复以及任务中断。
• 频道共识:模型能力之外,工具协议适配、消息结束标记、代理实现和客户端版本同样会决定 Agent 是否真正可用。
4. CPA、New API、sub2api 与 Codex 生态持续调整
• 有教程介绍在 New API 套 CPA 的情况下,为 Codex 增加独立 Web Search 能力,关键在于供应商配置中启用
supports_standalone_web_search true,并正确设置渠道类型。• 发帖者称,原先使用 sub2api 时 Codex 认证、用量记录和 Web Search 之间存在兼容问题,因此改用 New API 与 CPA 组合;但该方案涉及多层转发,配置复杂度和维护成本也随之增加。
• 频道内多次出现“Tibo继续支持 CPA”“CPA再次官方认证可用”的转述,带动用户询问 Luna Reserve、模型切换、缓存命中率与账号池稳定性。
• 同时,sub2api-xray 项目作者称 GitHub 账号和仓库频繁遭遇风控,建议有需要的用户及时保存项目;这也反映出相关工具项目对账号、代理和平台审核高度敏感。
• 注意:中转、共享账号和第三方 API 的可用性变化很快,公开帖中的“官方支持”或“稳定可用”仍应以服务商实际公告和个人测试为准。
5. AI 编程产品的速度、额度与价格矛盾集中爆发
• 用户吐槽 Qoder 与 Token Plan 分开计费,Qoder 自身额度少且运行速度慢;一名用户两天产生约 200 万未缓存输入、超过 2.5 亿缓存输入和约 100 万输出,项目仍未完成,并质疑产品线与模型调用关系。
• Codex 也被指执行缓慢,有用户称十几分钟只修改了一百多行代码;多开 Agent、并行开发和子 Agent 能否提速,成为频道反复讨论的问题。
• Claude Code 则被发现可能命中“Bash-first”策略:在 Auto 模式下优先用 Bash 读取和编辑文件,而不是原生 Read / Write / Edit 工具。发帖者认为这会增加 Token 消耗,并导致速度和完成质量下降。
• 另有用户反馈 Zed 预测功能开始收费,WorkBuddy 的 HY4 使用一下午便返回 429,所谓限免周期与实际额度之间存在落差。
• 共同问题并非单纯“哪个模型最强”,而是单位成本完成任务的效率、上下文消耗、工具调用可靠性以及限额透明度。
6. 硬件与本地模型部署讨论升温:ROCm 10、DGX Spark 与 Qwen 3.8
• 频道转述 AMD 正式发布 ROCm 10,版本号从 ROCm 7.14 跳跃升级;Windows 侧据称将原有独立 HIP SDK 并入与 Linux 统一的 ROCm Core SDK,并加入面向 AI 开发的整合能力。
• 消息还称,ROCm 10 接入 Claude Code、Cursor 等编程工具,并在 8 张 Instinct MI355X 加速卡平台上展示大幅推理性能提升;具体性能数字和测试条件仍需以 AMD 完整资料核验。
• 有用户比较“付费 API”与购买 DGX Spark 的成本,询问两台设备能够运行哪些模型;另有帖子讨论以 170HX 等硬件部署 Qwen 3.8 27B 全精度或 F8 版本。
• NexGPU 宣布重构算力平台,重新整理供应商与实例模板,预装 PyTorch、vLLM、Ollama、ComfyUI、Stable Diffusion、Whisper、LLaMA Factory、Unsloth 等环境,目标是降低 GPU 租用和部署门槛。
• 本地部署的关键仍是显存、带宽、量化精度、并发需求与软件栈兼容性,不能只按模型参数量或宣传性能做购买决定。
7. 多模态应用从“能生成”转向“能定位、能操作”
• 有开发者将基于 Gemini 的视频导航和 PDF 定位功能整合进自己的聊天工具:用户拖入视频后,模型可根据问题定位相关片段;分析 PDF 时则返回相关页码并标注位置。
• Fal.ai 上出现无需登录、每日可生成 5 条视频的 MiniMax H3 Max 体验,单条约 5 秒、分辨率为 768p,主打较快生成速度;用户反馈速度突出,但生成额度显示不透明,且高分辨率仍需其他版本。
• 频道也讨论了视频分镜之间风格一致性不足的问题:单个短片效果尚可,但连续生成漫剧或多镜头内容时,人物和画面风格容易漂移,成本控制同样是实际门槛。
8. 求职诈骗窝点被查,频道转发案例提醒防范“高薪岗位”陷阱
• 据转发消息,中国警方侦破一个通过虚假招聘信息为求职诈骗引流的窝点,刑事拘留 10 人。
• 犯罪嫌疑人利用人力资源中介便利,在智联招聘、BOSS 直聘、抖音、58 同城、小红书等平台发布虚假岗位,声称可以安排国家电网、部队文职、三甲医院等工作。
• 已发现 106 人被骗,涉案金额超过 1000 万元;受害者被引导至线下后,与所谓中介签订“就业合同”,并被分批收取高额介绍费用。
• 求职时凡是承诺“内部安排”“无需考试”“缴费即可入职”的岗位,都应通过官方招聘渠道和用人单位公开联系方式交叉核验。
二、分主题深读
🤖 AI 模型、额度与订阅
• 模型选择从“能力排行”转向“任务经济学”:频道围绕 GPT、Claude、Gemini、Grok、GLM、Qwen、DeepSeek、豆包、Kimi 等模型展开比较。用户普遍承认国产模型进步明显,但在复杂推理、长文本稳定性和创意一致性方面,仍会在关键任务中切回高价海外模型。
• Qwen 3.8 Max 被指思考时间过长:有 Standard 用户反馈,一次思考接近 40 分钟,消耗约 13% 周配额;如果用于真实开发任务,可能出现“额度已消耗大半、需求仍未完成”的情况。
— message 1 of 2 —