📡 Linux.do 频道日报 · 夜报
有效消息 115 条

📡 Linux.do 频道日报 · 2026-08-23
单一频道综合 · 已去重整理

今日一句话:频道讨论高度集中于 AI 订阅、模型路由、额度缩水与中转稳定性。用户一面比较 DeepSeek、GLM、GPT、Grok、Gemini 的真实开发表现,一面开始更重视账号风控、密钥安全、缓存命中和 Agent 工具链的可控性。


一、今日要闻

1. AI 订阅与中转生态出现集中性不稳定,用户对“降智”、限流和封号的抱怨升温
• GPT 网页端、Codex、Team 轮转与多家中转服务均出现额度未重置、请求中断、Rate limit exceeded、模型疑似被路由至低规格版本等反馈。
• 有用户称 GPT 网页端的 sol-high 被路由至 5.5 mini;另有服务方称认证文件成功率下降、轮换账号耗时超过 5 分钟,且当日模型中断频繁。
• Codex 用户发现,提前使用“重置卡”后,原定于 23 日的周额度重置被顺延至 30 日,显示赠送额度与周期额度的交互规则仍不透明。
• 影响:依赖共享账号、聚合平台或自动轮转的开发流程,面临比官方订阅更高的不确定性;关键任务应准备模型与供应商备份。

2. DeepSeek V4 Flash Vision 版受到开发者关注,视觉自检被视为代码 Agent 的有效补强
• 多名用户讨论新推出的 DeepSeek V4 Flash Vision Exp:相比 Flash-0731,视觉输入让模型能够通过截图识别渲染错误并自行修复。
• 有测试者要求模型用 Node.js 制作单机网页版“我的世界”,称 Vision 版单轮即可得到可运行结果;旧版则需约 7 轮迭代,且无法直接依据界面状态纠错。
• 频道中也出现建议:在 CommandCode、OpenCode 等环境选择带视觉标识的新模型,避免普通 Flash 可能存在的第三方部署差异或能力折损。
• 为何重要:多模态模型的价值不只在识图问答,而在于把浏览器截图、UI 验收和自主修复纳入闭环。

3. Ox-alpha 的能力、来源与调用速度成为热点,实测显示其软件工程能力具竞争力
• 基于 DeepSWE v1.1 的社区单次测试中,Ox-alpha-free 在 113 个任务里通过 73 个,报告通过率为 64.6%;测试使用 mini-SWE-agent,单题最长运行时间扩至 10 小时。
• 发帖者给出的定位是:能力超过 dsv4f/dsv4p,但仍落后于 luna;该结论来自单套 Benchmark 与单次采样,不能等同于完整模型排名。
• 另有用户发现,使用同一免费模型 ox-alpha 时,OpenRouter 可达约 46 tok/s,而 OpenCode 仅约 20 tok/s,讨论焦点转向上游排队、地区出口、网关实现与缓存策略。
• 有帖子依据 tokenizer 特征、参数报错和内部路由痕迹,推测 Ox-alpha 可能与 z.ai 有关联;目前属于社区推断,尚无官方确认。

4. Grok Build SuperGrok 被实测周用量明显缩水,单位 Token 成本变化不大
• 用户以相近条件对比两周测试:相同 CLI 版本、约 35 万输入、64 个工具回合、12 路并发与约 96.5% 缓存占比下,新增 Token 从约 2.40 亿 降至约 1.26 亿。
• 按完整周限额外推,报告认为可用总量从约 2.45 亿 Token 降至约 1.28 亿 Token,接近减半;但每百万 Token 等价成本约 0.188,变化有限。
• 补充:这类测算取决于 Token 统计口径、缓存比例和任务形态,适合观察趋势,不宜直接外推到所有订阅用户。

5. 账号与支付风控成为实际成本,误封申诉案例提供了有限但可复用的处理路径
• 一名日本区 Google Play 订阅用户称,升级 GPT Pro 数日后遭封禁;多次 Appeal 均获自动回复并被拒,后改为申请导出数据。
• 客服在数据导出流程中表示需先解封,并最终认定其账号为误封;账号恢复后,退款申请也获通过,整个过程耗时两周以上。
• 发帖者怀疑风险可能来自曾被滥用的“脏 IP”或同号段信誉,而非单纯的并发、反代或多人使用。
• 影响:账户被限制时,保留订阅、申诉、数据导出和支付退款的沟通记录,比反复切换环境更有助于后续处置。

6. API Key 暴露、拼车失联与公共资源滥用风险被多起事件再次放大
• 有用户称两个未暴露公网的 Key 被异常消耗,其中一个账号额度被刷空,两个站点均使用 New API,怀疑存在扫描、配置漏洞或供应链风险。
• 家宽拼车也出现服务方失联、到期前无法响应的反馈;另有公益 API 站点公告称维护精力不足,仅保证基础访问,不再承诺模型稳定性。
• 频道内还出现公开 API Key、共享模型额度和低价账号资源等内容,这类信息不具备可靠持续性,也可能带来账号、资金和数据泄露风险。
• 为何重要:模型调用基础设施已成为攻击面,密钥权限、来源可信度、配额告警与审计日志应被视为基本配置。

7. Agent 的竞争焦点从“模型强弱”转向 Harness、技能治理与浏览器执行能力
• 一名开发者在构建学习 Agent 时逐步加入图谱、聊天、文件、Shell、Sandbox、Skill、Memory、子应用、联网和 Artifact,认为自己实际在搭建 Harness。
• 其核心观察是:同一模型置于不同 Harness 后,长任务表现可能像两个模型,关键差异来自工具边界、上下文管理、子任务拆分、反馈回路与状态持久化。
• 开源工具 OneCode Skill Sanitizer 则提出对 Agent Skill 做规则化“安检”,重点扫描外部脚本直执行、绕过沙箱提示、明文 API Key 和不必要权限提升。
• 影响:企业或个人部署 Agent 时,Skill 不应被当作普通文本模板,而应按不可信代码与操作手册进行审查。

8. 消费硬件与基础设施成本上行的体感增强,内存价格成为代表性案例
• 用户展示 2024 年购买的同款内存条订单,称当前价格已接近翻倍,并戏称其为“理财产品”。
• 另有用户关注 M1 MacBook Pro 升级至满血 M4 Pro 的二手价格,发现市场挂牌价与回收价差距明显,12,000 元预算难以覆盖目标配置。
• 关于阿里巴巴拟进行 800 亿港元 港股配售的消息也被转发并置于全球 AI 算力竞争背景下讨论。
• 影响:模型训练、推理扩张与高端硬件需求,正在同时传导至服务器、内存、显卡及个人设备更新决策。

二、分主题深读

🤖 模型、额度与真实表现
• GPT 使用体验分化:频道内既有“挤不进 GPT”、网页持续 reconnecting、11 点额度未重置的反馈,也有对网页端模型降级、共享 Team 额度过快消耗的质疑。部分用户使用“糖果题”“水杯题”等自制小题测试模型是否降智,但讨论也指出:简单题容易受提示方式影响,复杂题又会被代码暴力搜索掩盖模型差异。
• GLM、DeepSeek、Kimi 的开发取舍:有用户认为复杂编程任务中 GLM 仍较稳,但 GLM 5.3 供应有限且速度慢;DeepSeek 被评价为快、指令遵循较好,但代码质量存在争议;Kimi 前端生成获得好评,后端和工具调用稳定性则评价不一。
• Gemini 新旧知识与环境差异:用户反馈 Gemini 3.7 的知识时效性疑似不如 3.6,也有人称其在 Antigravity 中表现可用、迁入 VPS 上的 OpenClaw 后却明显变慢且难以完成任务。讨论指向运行环境、工具反馈和提示上下文,而非单纯模型版本。
• Grok 的订阅和可用性:除 SuperGrok 周限缩水外,用户还讨论是否还能订阅 Grok 4.6、网页每月 8 美元 Premium 是否附带 Cursor 额度等问题。现有信息未形成可靠共识,订阅权益应以官方订单页和控制台为准。
• Codex 配置变动:新版 Codex 有用户报错 X-OpenAI-Internal-Codex-Responses-Lite requires parallel_tool_calls to be false,导致经 cc-switch 使用中转失败;这说明客户端协议变更可能先于中转兼容更新,需要关注调用参数及服务端适配状态。

🛠 Agent、开发工具与工程实践
— message 1 of 2 —