📡 Linux.do 频道日报 · 夜报
有效消息 168 条
📡 Linux.do 频道日报 · 2026-09-01
多源综合 · 已去重整理
一、今日要闻
1. Ollama Cloud 新套餐转向 Token Plan,用户担忧实际可用量缩水
• 多位用户称收到邮件:新购 Ollama Cloud 套餐将改为按 Token 额度计费,讨论中的 Pro 20 美元档约对应 60 美元用量。
• 部分重度用户按自身周消耗估算,在缺少缓存收益的前提下,该额度可能仅够使用约一周半;DeepSeek V4 Flash 还被指按较高价格计入消耗。
• 社区普遍建议已持有旧套餐者谨慎升级,并将套餐价格、缓存命中、上下文长度和工具调用开销一并纳入比较。
• 影响:AI Coding 从“订阅不限感知使用”转向精细计量,重度开发者的月度成本与工作流需要重算。
2. GPT、Claude、Codex 额度与稳定性问题集中出现
• GPT 20x 用户反馈重置后额度明显“不耐用”,有人估算周额度约仅剩 1100 多美元;官方网页端缓存命中率下降也被多次提及。
• Claude Max 20x 用户称从 5x 升级后未感受到等比例提升,长对话恢复后单轮可能消耗约 3% 周额度;智谱 Coding Plan 则出现周限额重置卡。
• Codex 侧出现频繁重新连接、长任务反复扫描、PR 合并过程消息大量膨胀、桌面端安装报错,以及升级 ChatGPT 后 Computer Use 入口消失等反馈。
• 共识:用户体感问题未必都来自模型能力变化,缓存、上下文压缩、Agent Harness、路由和客户端更新都可能放大额度消耗与响应波动。
3. “模型降智”讨论升温:思考档位、路由和工具链被认为是关键变量
• 有用户对比称 GLM 5.3 在 ZCode 中的输出速度显著快于 GPT 5.6 Sol;也有人发现 Cline 中 DeepSeek V4 Flash 选择 high/xhigh/max 后,反而快速但答错测试题。
• 火山 Coding Plan 的 GLM 5.3 Flash 被反馈出现重复思考;WorkBuddy 中 DeepSeek V4 Flash 则被称响应异常缓慢。
• 社区倾向于将“降智”拆解为模型本身、上游默认推理参数、缓存、并发排队、上下文污染及工具注入等问题,而非仅看模型名称。
• 待验证:不同平台对“思考等级”参数是否真正透传、是否触发不同路由,仍缺少可复现的公开结论。
4. 安全警报:所谓“极点云免费 VPS”被指疑涉钓鱼与 iOS 攻击链
• 频道内转发安全预警称,“极点云免费 VPS”活动已被曝光存在风险,并附带关于钓鱼活动及 iOS 零点击攻击链 的分析材料。
• 用户被提醒不要因免费主机、赠金或限时福利提交账号、支付信息、设备描述文件或不明配置。
• 影响:免费云资源、账号福利和低价中转服务的安全审查需求上升;涉及主账号与支付方式时尤其应避免盲目尝试。
5. OpenAI、Grok 与模型生态持续更新,消息真伪与功能变化并存
• 有消息称 OpenAI 于 9 月 1 日上线官方礼品卡,可用于赠送、订阅与续费;另有用户发现 GPT 网页端似乎支持多个账号同时登录。
• Grok 侧出现 3 天试用邮件、订阅额度推测,以及 Bot 调用可能占用 API 额度的讨论;部分用户继续反馈账号在 Build 等场景后体验下降。
• 网传 GPT-6 Astra、Gemini 3.8 Flash 发布等消息尚未获频道内可靠证实,应与正式公告区分。
• 重点:围绕礼品卡、代充、拼车和低价账号的交易风险仍高,功能更新不等于支付与账号使用方式已被官方完全放开。
6. 端侧与本地 AI 硬件热度上升:从手搓键盘到科研 GPU 配置
• 有专科学生记录制作带屏 AI 键盘的创业尝试,目标是显示后台 AI 任务状态、减少多窗口切换;原型阶段已经历屏幕与芯片损耗。
• 科研团队提出 25 万元 GPU 预算,在 RTX Pro 6000D、多张 A6000 与国产卡之间权衡训练显存、PyTorch 兼容性和未来本地推理需求。
• 另有用户讨论 MAX 395 控制 5080/9800X3D 的展示方案,以及约千元级 Orin X 开发板本地运行 Qwen 35B 的可玩性。
• 趋势:本地部署不再只是“跑得起来”,而开始关注显存、稳定性、交互展示、散热与可维护性。
7. 社区治理与内容边界引发讨论,多名用户询问删帖原因
• 有用户称帖子或回复被删除、隐藏后未收到明显系统通知,因此询问具体触犯的规则;其中涉及共享站链接、推广内容等场景。
• 同日也出现多条中转站、免费模型、内推和资源推广信息,内容质量差异较大。
• 提醒:公开分享链接、代理、账号、代充或高风险资源时,需同时考虑社区准则、来源可验证性及对其他用户的安全影响。
二、分主题深读
🤖 AI 与算力
• 讯飞星火 X2.5 端侧模型发布:讯飞宣布开源 X2.5-4B 与 X2.5-1.7B,称采用混合注意力架构,并针对智能体、代码、数学和指令遵循优化;权重已在 Hugging Face、GitHub 等渠道开放,API 在星辰 MaaS 平台限时免费。
节点:官方信息称 9 月 7 日还将发布 X2.5-293B 通用大模型。
• AI 编程工具的“长任务管理”成为实际痛点:一项开源 Skill 尝试让 Codex 在启动长脚本后暂停无意义轮询,在脚本结束时再通知 Agent,以减少上下文被持续占用。
背景:下载数据、训练模型、Agent 评测等任务若被频繁轮询,可能同时带来 Token 消耗、上下文压缩和任务状态不透明的问题。
• MCP 被用于解决编辑器交互类顽固问题:有开发者在 Tiptap 编辑器项目中引入 MCP,让模型调用真实操作与测试流程,覆盖嵌套列表、Tab/Shift+Tab、删除和退格等交互案例。
启示:对于仅靠文本描述反复修改仍无法收敛的问题,让 Agent 获得可观测、可验证的操作环境,可能比继续堆提示词更有效。
• AI 对初中级程序员的冲击引发职业焦虑:一名 2025 届前端开发者称,求职面试从传统技术细节转向 AI 工具、Vibe Coding、RAG 与场景题,原有学习路径的价值感受到冲击。
频道讨论反映:市场并未只要求“会写代码”,而是更看重能否把模型、工具、工程约束和交付结果结合起来。
• “人形 Agent”成为职场新负担:有用户描述自己因较早接触 AI,被多位领导同时分派 PPT 重写、CSV 分析、AI 提效方案和 API 保活等工作。
风险:AI 提效若缺少任务边界、权限与资源配置,可能把零散需求集中转嫁给少数熟悉工具的员工。
💳 订阅、额度与平台选择
• 平台比较从标价转向真实单位产出:用户讨论月预算 600 元、目标约 80 亿 Token 的可行性,也有人统计自己高强度调用下,10 美元或 20 美元档套餐远不够用。
比较维度应包括:输入/输出价格、缓存规则、模型路由、并发限制、长上下文、工具调用、失败重试及售后透明度。
• 超算互联网 Token Plan 被用户质疑扣费不透明:一名用户称调用 GLM 5.3 时未看到缓存效果,二十余次调用已消耗套餐十余个百分点,单次最高记录为数万积分;其称客服将现象定义为正常。
这是单用户反馈,尚不足以代表平台整体;但采购前应先用小额度验证日志、缓存、限速与退款规则。
• GLM Coding Plan 发放周限额重置卡:多名用户晒出重置卡,恰逢其周额度耗尽或接近耗尽;同时频道内也提供了 GLM 5.3/5.3 Flash 的 7 天编程体验活动信息。
观察点:福利能缓解短期用量,但不能替代对稳定性、限额周期和模型质量的长期评估。
• Grok 订阅和额度仍缺乏清晰共识:讨论中对 X Premium、SuperGrok 等产品的可用额度给出了非官方推测;另有用户称 Grok Bot 可能比常规 API 调用更快消耗额度。
— message 1 of 2 —
有效消息 168 条
📡 Linux.do 频道日报 · 2026-09-01
多源综合 · 已去重整理
今日一句话:频道讨论高度集中于 AI 编程订阅的额度、计费与“降智”体验:Ollama Cloud 改按 Token 计费、GPT/Claude/Codex 多项异常反馈叠加,用户开始重新评估模型、平台与本地算力的性价比;与此同时,免费 VPS、代充、账号与云服务注册风险也成为高频警报。
一、今日要闻
1. Ollama Cloud 新套餐转向 Token Plan,用户担忧实际可用量缩水
• 多位用户称收到邮件:新购 Ollama Cloud 套餐将改为按 Token 额度计费,讨论中的 Pro 20 美元档约对应 60 美元用量。
• 部分重度用户按自身周消耗估算,在缺少缓存收益的前提下,该额度可能仅够使用约一周半;DeepSeek V4 Flash 还被指按较高价格计入消耗。
• 社区普遍建议已持有旧套餐者谨慎升级,并将套餐价格、缓存命中、上下文长度和工具调用开销一并纳入比较。
• 影响:AI Coding 从“订阅不限感知使用”转向精细计量,重度开发者的月度成本与工作流需要重算。
2. GPT、Claude、Codex 额度与稳定性问题集中出现
• GPT 20x 用户反馈重置后额度明显“不耐用”,有人估算周额度约仅剩 1100 多美元;官方网页端缓存命中率下降也被多次提及。
• Claude Max 20x 用户称从 5x 升级后未感受到等比例提升,长对话恢复后单轮可能消耗约 3% 周额度;智谱 Coding Plan 则出现周限额重置卡。
• Codex 侧出现频繁重新连接、长任务反复扫描、PR 合并过程消息大量膨胀、桌面端安装报错,以及升级 ChatGPT 后 Computer Use 入口消失等反馈。
• 共识:用户体感问题未必都来自模型能力变化,缓存、上下文压缩、Agent Harness、路由和客户端更新都可能放大额度消耗与响应波动。
3. “模型降智”讨论升温:思考档位、路由和工具链被认为是关键变量
• 有用户对比称 GLM 5.3 在 ZCode 中的输出速度显著快于 GPT 5.6 Sol;也有人发现 Cline 中 DeepSeek V4 Flash 选择 high/xhigh/max 后,反而快速但答错测试题。
• 火山 Coding Plan 的 GLM 5.3 Flash 被反馈出现重复思考;WorkBuddy 中 DeepSeek V4 Flash 则被称响应异常缓慢。
• 社区倾向于将“降智”拆解为模型本身、上游默认推理参数、缓存、并发排队、上下文污染及工具注入等问题,而非仅看模型名称。
• 待验证:不同平台对“思考等级”参数是否真正透传、是否触发不同路由,仍缺少可复现的公开结论。
4. 安全警报:所谓“极点云免费 VPS”被指疑涉钓鱼与 iOS 攻击链
• 频道内转发安全预警称,“极点云免费 VPS”活动已被曝光存在风险,并附带关于钓鱼活动及 iOS 零点击攻击链 的分析材料。
• 用户被提醒不要因免费主机、赠金或限时福利提交账号、支付信息、设备描述文件或不明配置。
• 影响:免费云资源、账号福利和低价中转服务的安全审查需求上升;涉及主账号与支付方式时尤其应避免盲目尝试。
5. OpenAI、Grok 与模型生态持续更新,消息真伪与功能变化并存
• 有消息称 OpenAI 于 9 月 1 日上线官方礼品卡,可用于赠送、订阅与续费;另有用户发现 GPT 网页端似乎支持多个账号同时登录。
• Grok 侧出现 3 天试用邮件、订阅额度推测,以及 Bot 调用可能占用 API 额度的讨论;部分用户继续反馈账号在 Build 等场景后体验下降。
• 网传 GPT-6 Astra、Gemini 3.8 Flash 发布等消息尚未获频道内可靠证实,应与正式公告区分。
• 重点:围绕礼品卡、代充、拼车和低价账号的交易风险仍高,功能更新不等于支付与账号使用方式已被官方完全放开。
6. 端侧与本地 AI 硬件热度上升:从手搓键盘到科研 GPU 配置
• 有专科学生记录制作带屏 AI 键盘的创业尝试,目标是显示后台 AI 任务状态、减少多窗口切换;原型阶段已经历屏幕与芯片损耗。
• 科研团队提出 25 万元 GPU 预算,在 RTX Pro 6000D、多张 A6000 与国产卡之间权衡训练显存、PyTorch 兼容性和未来本地推理需求。
• 另有用户讨论 MAX 395 控制 5080/9800X3D 的展示方案,以及约千元级 Orin X 开发板本地运行 Qwen 35B 的可玩性。
• 趋势:本地部署不再只是“跑得起来”,而开始关注显存、稳定性、交互展示、散热与可维护性。
7. 社区治理与内容边界引发讨论,多名用户询问删帖原因
• 有用户称帖子或回复被删除、隐藏后未收到明显系统通知,因此询问具体触犯的规则;其中涉及共享站链接、推广内容等场景。
• 同日也出现多条中转站、免费模型、内推和资源推广信息,内容质量差异较大。
• 提醒:公开分享链接、代理、账号、代充或高风险资源时,需同时考虑社区准则、来源可验证性及对其他用户的安全影响。
二、分主题深读
🤖 AI 与算力
• 讯飞星火 X2.5 端侧模型发布:讯飞宣布开源 X2.5-4B 与 X2.5-1.7B,称采用混合注意力架构,并针对智能体、代码、数学和指令遵循优化;权重已在 Hugging Face、GitHub 等渠道开放,API 在星辰 MaaS 平台限时免费。
节点:官方信息称 9 月 7 日还将发布 X2.5-293B 通用大模型。
• AI 编程工具的“长任务管理”成为实际痛点:一项开源 Skill 尝试让 Codex 在启动长脚本后暂停无意义轮询,在脚本结束时再通知 Agent,以减少上下文被持续占用。
背景:下载数据、训练模型、Agent 评测等任务若被频繁轮询,可能同时带来 Token 消耗、上下文压缩和任务状态不透明的问题。
• MCP 被用于解决编辑器交互类顽固问题:有开发者在 Tiptap 编辑器项目中引入 MCP,让模型调用真实操作与测试流程,覆盖嵌套列表、Tab/Shift+Tab、删除和退格等交互案例。
启示:对于仅靠文本描述反复修改仍无法收敛的问题,让 Agent 获得可观测、可验证的操作环境,可能比继续堆提示词更有效。
• AI 对初中级程序员的冲击引发职业焦虑:一名 2025 届前端开发者称,求职面试从传统技术细节转向 AI 工具、Vibe Coding、RAG 与场景题,原有学习路径的价值感受到冲击。
频道讨论反映:市场并未只要求“会写代码”,而是更看重能否把模型、工具、工程约束和交付结果结合起来。
• “人形 Agent”成为职场新负担:有用户描述自己因较早接触 AI,被多位领导同时分派 PPT 重写、CSV 分析、AI 提效方案和 API 保活等工作。
风险:AI 提效若缺少任务边界、权限与资源配置,可能把零散需求集中转嫁给少数熟悉工具的员工。
💳 订阅、额度与平台选择
• 平台比较从标价转向真实单位产出:用户讨论月预算 600 元、目标约 80 亿 Token 的可行性,也有人统计自己高强度调用下,10 美元或 20 美元档套餐远不够用。
比较维度应包括:输入/输出价格、缓存规则、模型路由、并发限制、长上下文、工具调用、失败重试及售后透明度。
• 超算互联网 Token Plan 被用户质疑扣费不透明:一名用户称调用 GLM 5.3 时未看到缓存效果,二十余次调用已消耗套餐十余个百分点,单次最高记录为数万积分;其称客服将现象定义为正常。
这是单用户反馈,尚不足以代表平台整体;但采购前应先用小额度验证日志、缓存、限速与退款规则。
• GLM Coding Plan 发放周限额重置卡:多名用户晒出重置卡,恰逢其周额度耗尽或接近耗尽;同时频道内也提供了 GLM 5.3/5.3 Flash 的 7 天编程体验活动信息。
观察点:福利能缓解短期用量,但不能替代对稳定性、限额周期和模型质量的长期评估。
• Grok 订阅和额度仍缺乏清晰共识:讨论中对 X Premium、SuperGrok 等产品的可用额度给出了非官方推测;另有用户称 Grok Bot 可能比常规 API 调用更快消耗额度。
— message 1 of 2 —