📡 Linux.do 频道日报 · 晚报
有效消息 232 条
📡 Linux.do 频道日报 · 2026-08-22
多源综合 · 已去重整理
一、今日要闻
1. GPT、Gemini 与新模型引发新一轮“第一梯队”讨论
• 频道集中讨论 Gemini 3.7、GPT 5.6、5.5、Ox Alpha、GLM 5.3、DeepSeek V4 Flash 等模型的能力、速度和路由差异。
• 有用户认为 Gemini 3.7 的发布反响较强,Google 可能借此重新回到头部竞争位置;同时,Google AI Studio 员工疑似参与 Ox Alpha 相关讨论,但目前只能视为线索,不能据此确认模型归属。
• GPT 5.6、GPT Sol 与 5.5 XHigh 的体验评价分化明显:部分用户反馈网页端或应用端变慢、降智、被路由到 mini,另一些用户认为 5.5 在实际编程任务中更快、更少做无用功。
2. Codex 重置卡与额度状态出现大范围波动
• 多名 Plus、Pro 用户反馈收到或未收到重置卡,涉及 Plus、Pro 5x、Pro 20x 等不同订阅档位;有用户观察到,账号用量下降到某个区间后才出现重置卡,但这一规律尚未得到官方确认。
• 同期还出现额度减少、周限变化、额度恢复以及不同地区账号表现不一致等反馈。部分用户称重置后额度恢复正常,也有人估算实际可用额度明显下降。
• 频道内出现通过多账号、地区订阅、代充和共享套餐最大化额度的讨论,存在触发风控、账号失效或违反服务条款的风险。
3. GLM 5.3 “一亿 Token”福利出现领取和使用异常
• 用户反馈 ZCode 提供的一亿 Token 额度需要安装客户端,部分账号已经领取成功;也有用户在使用到一半后出现 Model request failed,甚至连新用户额度一并消失。
• 另有实测认为,ZCode 的 Token 消耗速度明显快于 GPT 订阅中的同等任务,可能与 Token 统计、上下文计算或计费方式不同有关。
• Ox Alpha、牛来、x-preview 等免费或低价渠道也被大量测试,但反馈包括首字延迟高、断流、429、503、上下文耗尽和修复一个问题引出多个问题,稳定性仍不明确。
4. DeepSeek V4 Flash Vision 开始进入多模态实测阶段
• DeepSeek V4 Flash Vision Exp 被接入 DeepSeek Harness,相关版本已增加模型支持。频道用户测试了图片理解能力,并认为 DeepSeek 正式进入多模态竞争。
• 目前该模型仍属于试验阶段,实际效果、速度和适用场景需要更多样本验证。围绕 DeepSeek 模型与识图模型的组合调用、截图对话和开发配置,也有用户寻求现成工具方案。
• 硅基流动国内站同步出现 DeepSeek V4 Flash 的 0731 版本更新,帖子称价格暂未变化。
5. Codex 与中转 API 的鉴权、代理和工具链问题集中爆发
• Codex 升级到 149 版本后,部分用户连接反代 API 时统一出现 401。已有排查结果显示,旧版 model_providers 配置缺少
• OpenCode、Trae、Hermes 等工具接入 OpenCode Go、DeepSeek 4 Flash 或其他自定义模型时,也出现供应商失败、工具调用失败和 400 错误。
• 有经验帖指出,OpenCode 使用 Node 网络栈,不一定读取系统代理;限制区域模型若要通过代理访问,需要正确设置环境变量或以带代理参数的命令启动。
6. AI Agent 从“能做”走向“能交付”,产品化问题受到关注
• 一家为电力企业提供软硬件服务的团队,正在探索面向电网基建远程督察的企业级 Agent:将传统视频监控识别升级为理解业务现场、辅助值班员发现风险,并进一步实现主动识别隐患。
• 讨论核心集中在产品方向是否成立,以及应当以 Agent 为核心,还是以传统业务工作流为核心。频道意见倾向于先围绕真实业务闭环、数据、权限和责任边界设计,再将 Agent 作为能力层,而不是为了追逐概念强行加入智能体。
• 另有用户讨论电商自动化、移动端 Agent、文档查询助手、Office 操作能力、Agent 会话记忆管理等问题,说明 Agent 已从单次对话逐渐进入长期项目协作和企业流程改造阶段。
7. AI 编程开始暴露高权限操作和生产安全风险
• 有用户在完全访问模式下同时使用 Claude 与 GLM 5.3 排查问题,后者疑似删除了一个包含多个项目源码和研究资料的文件夹,最终只剩下空目录。
• 另有 Codex 自动修改路由器固件、解包编译、串口调试和打包刷机的案例;虽然展示了自然语言驱动硬件开发的效率,但固件刷写、断电重启和批量设备操作都存在较高风险。
• 频道还出现 Codex 无限重启、重启电脑、ChatGPT 导致 Mac 卡死、Windows 更新后绿屏,以及生成代码被火绒拦截等反馈。高权限 Agent 不应直接作用于唯一工作目录或关键设备,备份、沙箱和人工确认仍是必要防线。
8. 数据隐私和中转站透明度成为高频安全话题
• 有用户发现某 DeepSeek 渠道的用量明细会展示用户提示词开头内容,提醒使用公益或低价中转站时不要发送隐私、密钥、内部资料或敏感业务信息。
• 频道同时讨论中转站是否保存聊天日志、是否能够修改输入输出 Token、缓存 Token 与倍率,以及低价公益站是否存在“产水”或超售问题。
• 另有疑似诈骗网站、账号导入 Sub2API 后 Token 失效、第三方账号依赖 refresh token 等问题。低价不等于可信,账号、支付和对话数据的控制权应当优先考虑。
9. 欧洲监管继续追问自动化决策的责任边界
• 帖子转述称,荷兰数据保护局因 Uber 使用自动化系统停用司机账号时未充分通知司机,对 Uber 处以 8.25 亿欧元罚款,约合 9.66 亿美元。
• 若报道属实,这将是欧盟通用数据保护条例实施以来金额最高的罚款之一,也再次凸显自动化封禁、账号停用和平台风控必须具备通知、解释和申诉机制。
• 这一事件与频道讨论的企业 Agent、电网远程督察、AI 招聘和自动化运营直接相关:系统不仅要判断准确,还必须能够说明依据,并允许人工复核。
10. AI 产业链继续向算力、硬件和基础设施延伸
• Cloverleaf Infrastructure 宣布与 NVIDIA 建立战略合作,并获得 NVIDIA 少数股权投资,双方将推进美国数字基础设施和 AI 工厂建设。
• Anthropic 被曝聘请 Google 芯片领域老将,外界据此猜测其正在加强硬件布局,但目前公开信息有限。
• 频道用户则从实际部署角度讨论 RTX 5090、DGX Spark GB10、Qwen 3.8 27B、SGLang、WSL 和本地推理,AI 竞争已从模型参数延伸到显存、推理框架、缓存和数据中心效率。
二、分主题深读
🤖 模型、推理与多模态
• Qwen 3.8 27B 本地部署表现受到关注:有帖子整理 RTX 5090 32GB、NVFP4 量化、FP8 lm_head、SGLang 和 DSpark 投机解码方案,实测峰值达到约 300 tok/s 级别;另有 32GB 显存运行 192K 上下文的测试报告,但长上下文下的速度和稳定性仍需结合具体任务判断。
• 本地部署门槛问题持续:用户围绕 Qwen 3.8、DeepSeek 等模型所需显卡、内存和上下文容量进行咨询。当前实际体验不只取决于模型大小,还受到量化格式、KV Cache、推理框架、显存带宽和上下文长度影响。
• 模型“会不会整活”成为轻量测试:多名用户让模型生成“鹈鹕骑自行车”的 HTML 或 SVG 动画,用于比较 GPT、Qwen、GLM 等模型的前端生成质量。结果显示,模型通常能够生成可运行的页面,但动画细节、动作合理性和审美仍存在明显差异。
• 模型身份猜测升温:Ox Alpha、牛来等模型被用户从回答风格、敏感内容处理方式和推理表现上判断为可能来自国内团队,但这些均属于社区推测,不能替代官方来源。
🧑💻 AI 编程与开发工作流
— message 1 of 2 —
有效消息 232 条
📡 Linux.do 频道日报 · 2026-08-22
多源综合 · 已去重整理
今日一句话:频道讨论高度集中在 AI 模型、代理服务与 Codex 等开发工具的额度、路由、稳定性和风控变化,同时也出现了本地部署、Agent 产品化、AI 基础设施与开发者工作方式转变等更具长期价值的话题。模型能力在快速迭代,但服务可靠性、计费透明度、数据隐私和误操作风险,正在成为实际使用中的主要瓶颈。
一、今日要闻
1. GPT、Gemini 与新模型引发新一轮“第一梯队”讨论
• 频道集中讨论 Gemini 3.7、GPT 5.6、5.5、Ox Alpha、GLM 5.3、DeepSeek V4 Flash 等模型的能力、速度和路由差异。
• 有用户认为 Gemini 3.7 的发布反响较强,Google 可能借此重新回到头部竞争位置;同时,Google AI Studio 员工疑似参与 Ox Alpha 相关讨论,但目前只能视为线索,不能据此确认模型归属。
• GPT 5.6、GPT Sol 与 5.5 XHigh 的体验评价分化明显:部分用户反馈网页端或应用端变慢、降智、被路由到 mini,另一些用户认为 5.5 在实际编程任务中更快、更少做无用功。
2. Codex 重置卡与额度状态出现大范围波动
• 多名 Plus、Pro 用户反馈收到或未收到重置卡,涉及 Plus、Pro 5x、Pro 20x 等不同订阅档位;有用户观察到,账号用量下降到某个区间后才出现重置卡,但这一规律尚未得到官方确认。
• 同期还出现额度减少、周限变化、额度恢复以及不同地区账号表现不一致等反馈。部分用户称重置后额度恢复正常,也有人估算实际可用额度明显下降。
• 频道内出现通过多账号、地区订阅、代充和共享套餐最大化额度的讨论,存在触发风控、账号失效或违反服务条款的风险。
3. GLM 5.3 “一亿 Token”福利出现领取和使用异常
• 用户反馈 ZCode 提供的一亿 Token 额度需要安装客户端,部分账号已经领取成功;也有用户在使用到一半后出现 Model request failed,甚至连新用户额度一并消失。
• 另有实测认为,ZCode 的 Token 消耗速度明显快于 GPT 订阅中的同等任务,可能与 Token 统计、上下文计算或计费方式不同有关。
• Ox Alpha、牛来、x-preview 等免费或低价渠道也被大量测试,但反馈包括首字延迟高、断流、429、503、上下文耗尽和修复一个问题引出多个问题,稳定性仍不明确。
4. DeepSeek V4 Flash Vision 开始进入多模态实测阶段
• DeepSeek V4 Flash Vision Exp 被接入 DeepSeek Harness,相关版本已增加模型支持。频道用户测试了图片理解能力,并认为 DeepSeek 正式进入多模态竞争。
• 目前该模型仍属于试验阶段,实际效果、速度和适用场景需要更多样本验证。围绕 DeepSeek 模型与识图模型的组合调用、截图对话和开发配置,也有用户寻求现成工具方案。
• 硅基流动国内站同步出现 DeepSeek V4 Flash 的 0731 版本更新,帖子称价格暂未变化。
5. Codex 与中转 API 的鉴权、代理和工具链问题集中爆发
• Codex 升级到 149 版本后,部分用户连接反代 API 时统一出现 401。已有排查结果显示,旧版 model_providers 配置缺少
requires_openai_auth true,导致 API Key 未按要求放入请求头。• OpenCode、Trae、Hermes 等工具接入 OpenCode Go、DeepSeek 4 Flash 或其他自定义模型时,也出现供应商失败、工具调用失败和 400 错误。
• 有经验帖指出,OpenCode 使用 Node 网络栈,不一定读取系统代理;限制区域模型若要通过代理访问,需要正确设置环境变量或以带代理参数的命令启动。
6. AI Agent 从“能做”走向“能交付”,产品化问题受到关注
• 一家为电力企业提供软硬件服务的团队,正在探索面向电网基建远程督察的企业级 Agent:将传统视频监控识别升级为理解业务现场、辅助值班员发现风险,并进一步实现主动识别隐患。
• 讨论核心集中在产品方向是否成立,以及应当以 Agent 为核心,还是以传统业务工作流为核心。频道意见倾向于先围绕真实业务闭环、数据、权限和责任边界设计,再将 Agent 作为能力层,而不是为了追逐概念强行加入智能体。
• 另有用户讨论电商自动化、移动端 Agent、文档查询助手、Office 操作能力、Agent 会话记忆管理等问题,说明 Agent 已从单次对话逐渐进入长期项目协作和企业流程改造阶段。
7. AI 编程开始暴露高权限操作和生产安全风险
• 有用户在完全访问模式下同时使用 Claude 与 GLM 5.3 排查问题,后者疑似删除了一个包含多个项目源码和研究资料的文件夹,最终只剩下空目录。
• 另有 Codex 自动修改路由器固件、解包编译、串口调试和打包刷机的案例;虽然展示了自然语言驱动硬件开发的效率,但固件刷写、断电重启和批量设备操作都存在较高风险。
• 频道还出现 Codex 无限重启、重启电脑、ChatGPT 导致 Mac 卡死、Windows 更新后绿屏,以及生成代码被火绒拦截等反馈。高权限 Agent 不应直接作用于唯一工作目录或关键设备,备份、沙箱和人工确认仍是必要防线。
8. 数据隐私和中转站透明度成为高频安全话题
• 有用户发现某 DeepSeek 渠道的用量明细会展示用户提示词开头内容,提醒使用公益或低价中转站时不要发送隐私、密钥、内部资料或敏感业务信息。
• 频道同时讨论中转站是否保存聊天日志、是否能够修改输入输出 Token、缓存 Token 与倍率,以及低价公益站是否存在“产水”或超售问题。
• 另有疑似诈骗网站、账号导入 Sub2API 后 Token 失效、第三方账号依赖 refresh token 等问题。低价不等于可信,账号、支付和对话数据的控制权应当优先考虑。
9. 欧洲监管继续追问自动化决策的责任边界
• 帖子转述称,荷兰数据保护局因 Uber 使用自动化系统停用司机账号时未充分通知司机,对 Uber 处以 8.25 亿欧元罚款,约合 9.66 亿美元。
• 若报道属实,这将是欧盟通用数据保护条例实施以来金额最高的罚款之一,也再次凸显自动化封禁、账号停用和平台风控必须具备通知、解释和申诉机制。
• 这一事件与频道讨论的企业 Agent、电网远程督察、AI 招聘和自动化运营直接相关:系统不仅要判断准确,还必须能够说明依据,并允许人工复核。
10. AI 产业链继续向算力、硬件和基础设施延伸
• Cloverleaf Infrastructure 宣布与 NVIDIA 建立战略合作,并获得 NVIDIA 少数股权投资,双方将推进美国数字基础设施和 AI 工厂建设。
• Anthropic 被曝聘请 Google 芯片领域老将,外界据此猜测其正在加强硬件布局,但目前公开信息有限。
• 频道用户则从实际部署角度讨论 RTX 5090、DGX Spark GB10、Qwen 3.8 27B、SGLang、WSL 和本地推理,AI 竞争已从模型参数延伸到显存、推理框架、缓存和数据中心效率。
二、分主题深读
🤖 模型、推理与多模态
• Qwen 3.8 27B 本地部署表现受到关注:有帖子整理 RTX 5090 32GB、NVFP4 量化、FP8 lm_head、SGLang 和 DSpark 投机解码方案,实测峰值达到约 300 tok/s 级别;另有 32GB 显存运行 192K 上下文的测试报告,但长上下文下的速度和稳定性仍需结合具体任务判断。
• 本地部署门槛问题持续:用户围绕 Qwen 3.8、DeepSeek 等模型所需显卡、内存和上下文容量进行咨询。当前实际体验不只取决于模型大小,还受到量化格式、KV Cache、推理框架、显存带宽和上下文长度影响。
• 模型“会不会整活”成为轻量测试:多名用户让模型生成“鹈鹕骑自行车”的 HTML 或 SVG 动画,用于比较 GPT、Qwen、GLM 等模型的前端生成质量。结果显示,模型通常能够生成可运行的页面,但动画细节、动作合理性和审美仍存在明显差异。
• 模型身份猜测升温:Ox Alpha、牛来等模型被用户从回答风格、敏感内容处理方式和推理表现上判断为可能来自国内团队,但这些均属于社区推测,不能替代官方来源。
🧑💻 AI 编程与开发工作流
— message 1 of 2 —