📡 Linux.do 频道日报 · 早报
有效消息 157 条

📡 Linux.do 频道日报 · 2026-08-18
单频道综合 · 已去重整理

今日主线:频道讨论高度集中于大模型订阅涨价、额度缩水与服务波动,用户开始重新比较 OpenCode、DeepSeek、GPT、Claude、Grok 及国产模型的实际性价比。与此同时,GitHub 故障、账号风控、反代与本地部署问题,继续暴露出 AI 开发工作流对第三方平台和网络基础设施的依赖。


一、今日要闻

1. DeepSeek 涨价引发订阅与模型迁移讨论
• 多名佬友反馈 DeepSeek 价格上调后,原本低成本的开发方案受到影响,开始寻找 GPT、Claude、Grok、GLM、Kimi 以及其他低价模型替代。
• 讨论中普遍认为,单看模型能力已经不足以判断性价比,还要结合订阅价格、可用额度、上下文长度、响应速度和封号风险综合计算。
• 有用户尝试使用 Muse Spark 1.2 Contributor,认为其在相近能力下价格较低,并支持 1M 上下文,但需要注意其数据可能被用于 Meta 训练。
• 频道内也出现对“订阅价格对应实际 API token 价值”的排行讨论,GPT 20x、Claude 20x 被提及为较高倍率方案,但具体数值仍取决于套餐规则和实际调用方式。

2. OpenCode Go 额度多次调整,用户观望情绪升温
• 频道消息显示,OpenCode Go 曾因 DeepSeek V4 Flash 调价而大幅削减额度,有帖子称五小时调用量被压缩至约 3800 次,降幅约 94%。
• 随后 OpenCode 又将部分 DeepSeek Flash 可用额度恢复至 30 美元,有用户认为用量回到约 60 美元的水平,接近此前状态,但也有人指出自部署渠道的模型质量仍不稳定。
• 另有反馈称进入所谓第二阶段后速度明显提升,约为前一日的三倍,甚至接近 Ollama;但速度提升是否伴随降智,仍是用户最关心的问题。
• OpenCode 调用 DeepSeek 时出现 Stream ended without finish_reason,部分用户怀疑与流式响应中断或服务端兼容性有关。

3. ChatGPT、Claude、Kimi 额度和活动规则频繁变化
• 有用户看到 ChatGPT 日额度从约 30下降到约10,也有人反馈出现“付费重置卡”,单张价格约 80 美元,具体适用范围尚不清楚。
• GPT Team 网页版也被反馈存在限额,部分用户在感觉使用量不高的情况下触发限制;GPT Plus、Pro、Team 之间的周限额和重置机制成为集中咨询内容。
• Kimi 邀请活动被指在短时间内反复取消、开放和结束,导致邀请额度消失;另有用户发现月额度重置后,七天额度并未同步重置,怀疑两套限额采用独立周期。
• Claude 账号封禁问题持续出现,有用户长期未登录后发现账号被封,申诉一周后仍收到无法解封的回复。部分用户猜测代理环境、账号历史行为或登录方式可能影响风控,但频道内没有形成确定结论。

4. Grok 4.6 的实际表现评价分化
• 有用户认为 Grok 4.6 在 Cursor、Build 等渠道中速度快、代码质量较高,可作为国产模型的性价比替代;也有人通过年付 Heavy、Cursor 或其他套餐寻找折扣。
• 另一批反馈则认为 Grok 4.6 在 Build 和 Cursor 中存在“只规划、不实际改文件”的问题,输出方案很完整,但没有完成仓库修改,反复追问后仍然只道歉不执行。
• 还有用户认为 Grok Heavy 当前存在降智、客户端体验差和 Android 端缺失等问题,建议将其视为“战未来”方案,实际生产使用仍需人工审阅。
• Grok 服务一度被用户怀疑故障,机器人持续报错;同时,Grok 4.6 被用于生成黑洞网页和图像,生成时间可达半小时以上,效果取决于任务类型和渠道。

5. GitHub 发生大面积故障后恢复
• 多名佬友反馈 GitHub 网页打不开、API 返回 503、Pull Request 页面异常、仓库和 Raw 内容访问失败,第三方状态监测页面也出现大面积故障标记。
• 频道转述的故障范围包括 Actions、API、Pull Requests、Issues、Webhooks、Archive 和 Raw 下载等核心服务,部分流量错误率据称达到约 20%,仓库 Archive 与 Raw 内容下载错误率接近50%。
• 随后有消息称服务恢复。此次事件再次提醒开发者:GitHub 已不只是代码托管平台,也成为 AI Agent 获取代码、提交变更、运行测试和发布项目的重要基础设施。
• 有用户排查 VS Code Git 同步失败时,最初误以为是代理问题,后来确认根因与 GitHub 故障有关;故障恢复后连接恢复正常。

6. 账号、反代和共享使用的安全风险集中暴露
• 有用户计划以每月约 400 元预算供六至七人共享 AI,比较共用 GPT Plus、OpenAI API、自建中转以及 DeepSeek 开放平台等方案。
• 讨论指出,共享账号可能触发异地登录、设备指纹和使用行为风控;Sub2API、CPA 等中转方案还涉及 OAuth 授权、第三方代理和不同客户端渠道,模型能力及可用模型列表可能与官方网页不一致。
• 有用户收到 OpenAI 的 cyber abuse 邮件,称主要用于逆向工程但没有使用破限提示词,担心账号被封。频道内建议重点区分合法分析、绕过访问限制、入侵或破坏等行为边界。
• 多条消息直接分享了 API Key、连接地址或编码后的凭据。此类内容存在额度被盗刷、账号被接管和个人信息泄露风险,相关凭据应立即撤销、轮换并检查账单。

二、分主题深读

🤖 AI 模型与开发体验

• 模型版本和路由稳定性受到质疑:有用户测试 DeepSeek 网页版 Flash 和 Pro,认为模型可能发生版本回退;另有 DSH 测试显示思维链模式、分词表现和输出风格存在差异,但目前无法仅凭少量重复测试确认是版本变化、路由变化还是随机性。

• Gemini 3.7 获得较高评价:频道用户称其文本表达、代码编写、发散能力、价格和速度均有明显提升,甚至被视为 DeepSeek V4 的升级型竞争者。不过,网页端使用体验和推理强度被认为不如 API 或开发工具渠道,C 端产品仍有明显落差。

• 国产模型进步与短板并存:有用户对 DeepSeek V4 Pro、GLM 5.3、Kimi K3 进行“魔方”类复杂任务测试,三者均完成了较多验证工作,耗时约 23 至 44 分钟。与此同时,GLM 在长上下文下速度下降,生成文档时还存在术语直译、缩写过多、表达压缩和黑话化等问题。

• Agent 工程问题比模型本身更常见:频道集中反馈两类故障:一是默认 max_tokens过小,模型输出过长后被截断,导致工具调用失败;二是采用非流式请求处理长思考任务时容易中断。建议开发者显式管理输出上限、流式事件、工具调用结束条件和异常重试,不要仅凭错误表现判断模型或供应商有问题。

• 上下文压缩和 Token 消耗成为隐形成本:有用户发现 Agent 未及时压缩上下文,后续每次请求都携带大量历史内容,导致 DeepSeek 余额消耗速度明显加快。PI Agent 也被反馈只有任务结束时才自动压缩,中途可能先超过上下文限制。对于长任务,应设置自动压缩阈值,并记录每次请求的输入、输出和缓存 token。

💻 本地部署、硬件与开源项目

• 4090D 本地运行 Qwen 3.8 27B:一名用户使用 24GB 显存的 RTX 4090D、llama.cpp、NVFP4 量化和视觉模块,将上下文配置到约 262K,短中上下文文本输出约 115 token/s。254K 上下文预填充速度约 623.7 token/s,但长上下文输出会降至约 30.8 token/s,视觉输出约 68 token/s。

• 小显存本地运行仍受限制:有用户询问 4GB 显卡是否会有 Qwen 3.8 的更小模型版本,也有人估算 24GB 内存的 M4 Pro 在本地运行 27B 模型时,20K 上下文可能需要等待数分钟,100K 上下文速度或降至每秒十余 token。

• WineFOX 降低 ComfyUI 使用门槛:开源项目通过前端页面对接 ComfyUI,支持自动检测环境、按 Lite、Full、Complete 版本补全依赖,并可识别和下载 LoRA,帮助用户减少手动配置生图环境的工作量。

— message 1 of 2 —