📡 资讯频道日报 · 夜报
有效消息 73 条
📡 资讯频道日报 · 2026-08-26
多源综合 · 已去重整理
一、今日要闻
1. 阿里发布并开源 Qwen3.8-Flash,AI 模型价格战再升级
• 阿里通义正式发布多模态 MoE 模型 Qwen3.8-Flash,总参数量约 125B,每个 token 实际激活约 6B 参数,并配备额外的 N-gram Embedding。
• 模型原生支持 262,144 token 上下文,可通过 YaRN 扩展至约 1M token;官方称其在编码、办公等任务上的表现较上一代更强。
• 阿里称训练成本约为 Qwen3.7-Plus 的九分之一,API 定价为每百万 token 输入约 1 元、输出约 3 元;模型权重已同步登陆 Hugging Face、ModelScope,并提供 FP8 量化版本。
• 阿里同时发布作为下一代架构预览的 Qwen3.8-Flash-Next,默认支持百万级上下文并内置官方工具。
补充:关于“比肩 Opus 4.6”“价格为同类模型三分之一”等说法主要来自官方或相关报道,实际能力与成本仍需第三方测评验证。
2. 智谱确认“Ox Alpha”为 GLM 系列新版本,免费模型冲上榜首
• 智谱回应称,近期突然走红的 Ox Alpha 确为其 GLM 系列新一代模型,代号灵感来自近期上映的电影《牛来》。
• 该模型目前免费开放,在 OpenRouter 在线使用排行榜升至首位,使用量据称已达到 DeepSeek 的两倍以上。
• 智谱计划于今晚公开模型权重,开发者可以基于权重进行二次开发、部署和产品集成。
• Qwen3.8-Flash 与 Ox Alpha 接连采取低价或开放权重策略,意味着中国 AI 厂商正把竞争重点从单纯模型发布,推进到开发者生态、API 消耗和办公入口争夺。
3. AI 产业进入“效率验证期”,英伟达财报成为市场风向标
• 市场等待英伟达公布季度业绩,华尔街预期每股收益约 2.09 美元、营收约 922.8 亿美元。公司市值已超过 5 万亿美元,财报影响不再局限于单一芯片公司。
• 摩根士丹利预计,英伟达下一代 Rubin 平台在截至 10 月的财季可能贡献接近 90 亿美元收入,投资者将重点观察量产时间和客户采购节奏。
• 机构称,英伟达可能通过芯片涨价及与供应商锁定更有利的 2027 年供货价格,缓解内存涨价对利润率的挤压;但利润率百分比仍可能下降。
• 当前市场核心问题是 Rubin 能否扩大 AI 算力市场,还是促使客户推迟采购 Blackwell。两种情形对供应链、芯片厂商和数据中心资本开支的含义完全不同。
4. 美国 7 月 PCE 高于预期,消费动能明显降温
• 美国 7 月总体 PCE 物价指数环比上涨 0.2%、同比上涨 3.7%;核心 PCE 环比上涨 0.2%、同比上涨 3.3%,总体数据略高于市场预期。
• 7 月个人消费支出增长 0.2%,低于前值 0.3%;个人收入增长 0.4%,高于市场预期。
• 第二季度个人消费支出年化季率修正为 3.4%,核心 PCE 物价指数年化季率修正为 3.6%,均高于初值。
• 数据表明通胀下降进程仍不顺畅,而消费在夏季初的强劲增长后出现降温。债券市场承压,10 年期美债收益率一度升至约 4.671%。
补充:市场接下来关注美联储主席在杰克逊霍尔年会上的讲话,以判断其对顽固通胀和后续利率路径的态度。
5. Meta 就青少年社交媒体危害诉讼达成大额和解
• Meta 同意与美国多个州就 Facebook、Instagram 对儿童和青少年造成伤害的诉讼达成和解,金额报道存在差异,约为最高 166.8 亿美元至 180 亿美元,仍需法院批准。
• 诉方指控 Meta 通过推荐算法、通知和产品设计提高未成年人使用黏性,同时未充分告知家长并取得同意,收集 13 岁以下儿童个人数据。
• 和解安排包括未来十年支付赔偿、默认限制每日使用时间、限制夜间使用、加强年龄确认,并接受独立机构监督。
• 该协议降低了 Meta 面临极端巨额赔偿的直接风险,但并未终结来自个人、学校和其他州的诉讼;TikTok、YouTube、Snap 等平台也面临类似法律压力。
6. 日喀则吉隆县泥石流造成重大伤亡,跨境救援仍在进行
• 中国西藏日喀则市吉隆县及吉隆口岸遭遇山洪、泥石流,洪流冲入口岸区域,造成道路、电力和通信中断,多辆汽车及大巴受到冲击。
• 尼泊尔一侧拉苏瓦地区灾情严重,已报告至少 22 人死亡,仍有数百人下落不明;尼泊尔旅游部门登记有 384 名旅客失联,其中 291 人为外国公民。
• 博特科西河沿线水电项目受到影响,约 430 兆瓦发电能力受冲击,约占尼泊尔水电装机能力的 12% 以上。
• 目前“失联”名单并不等同于确认遇难,部分人员可能因通信中断无法联系。灾害成因仍在调查,研究人员推测山区冰岩崩塌或曾堵塞河道,随后形成突发溃泄。
补充:有关方面已要求全力搜救失联人员,并排查整治各类风险隐患。
7. 盖茨警告 AI 风险已越过多条安全红线
• 比尔·盖茨称,最先进 AI 模型在生物安全、网络攻击、就业冲击和心理依赖方面的风险,已达到应触发更严格安全措施的程度。
• 他尤其担心能够设计新型分子的模型被复制到缺乏监管的环境,用于研发危险病原体或生物武器,并认为行业高管私下的担忧程度高于公开表态。
• 盖茨认为,AI 正以更低成本完成大量认知工作,白领入门岗位将首先受到冲击;与过去工业革命不同,AI 可能同时进入多个行业,使劳动力转移更加困难。
• 他建议保留部分明确的人类职业,对替代人类工作的 AI 或机器人征税,并推动美国与中国围绕生物安全建立合作机制。
补充:盖茨并未否定 AI 在医疗、教育、农业和公共服务领域的价值,但认为技术进步已快于监管和社会适应能力。
8. Rockstar 回应《GTA 6》泄露,确认仍计划 11 月 19 日发售
• Rockstar Games 首次针对近期《侠盗猎车手 6》视频泄露事件公开声明,称泄露令开发团队“心碎”,并非希望玩家看到游戏的方式。
• 公司表示,游戏最终完成已接近尾声,后续仍将公布更多细节和官方 gameplay,希望玩家暂时避免受剧透影响。
• 目前公开计划的发售日期仍为 11 月 19 日。泄露事件可能影响营销节奏、社区讨论和玩家对正式体验的预期。
二、分主题深读
🤖 AI 模型、算力与开发者生态
• 模型竞争转向“低激活参数 + 长上下文”:Qwen3.8-Flash 以 125B 总参数、6B 激活参数和百万级上下文为卖点,反映 MoE 架构正在成为控制推理成本、提升吞吐量的重要路径。对于企业而言,实际调用成本、延迟和工具调用稳定性,可能比总参数量更具决定性。
• 开放权重成为扩大生态的关键手段:智谱 Ox Alpha、阿里 Qwen3.8-Flash 均强调权重开放。开放模型可降低开发者对单一 API 的依赖,但也会带来模型滥用、部署安全、版权责任和算力门槛等问题。
• 腾讯开源多模态嵌入模型:微信视觉团队发布 WeMM-Embedding,提供 2B、4B、9B 三种规格,支持文本、图像、视频、视觉文档以及混合多模态输入的表示与检索,采用 Apache 2.0 协议。模型暂不支持音频输入,但有望用于企业知识库、跨模态搜索、内容审核和文档理解。
• OpenAI 自研芯片强调能效:OpenAI 公布自研芯片 Jalapeño 的部分测试数据,称其每瓦 AI 吞吐量约为 GB200、GB300 对比系统的 1.5 至 1.9 倍,端到端延迟约为对比系统的 28% 至 59%。测试口径、工作负载和量产计划仍需进一步确认。
• 端侧机器人算力继续下沉:英伟达发布 Jetson Orin Nano 2,标准模式 AI 算力达到 78 TOPS,搭载 8 核 Arm CPU 和 8GB 内存,官方称推理能力约为前代两倍,定位更接近机器人、边缘视觉和本地智能体设备。
📱 智能体、软件与消费电子
— message 1 of 2 —
有效消息 73 条
📡 资讯频道日报 · 2026-08-26
多源综合 · 已去重整理
今日主线:AI 模型竞争从“参数规模”进一步转向推理成本、开放权重与企业工作流落地,阿里、智谱、腾讯密集推出新模型。与此同时,美国通胀黏性、Meta 青少年诉讼和 AI 安全争议,显示技术扩张正同时面临宏观、监管与社会风险约束。
一、今日要闻
1. 阿里发布并开源 Qwen3.8-Flash,AI 模型价格战再升级
• 阿里通义正式发布多模态 MoE 模型 Qwen3.8-Flash,总参数量约 125B,每个 token 实际激活约 6B 参数,并配备额外的 N-gram Embedding。
• 模型原生支持 262,144 token 上下文,可通过 YaRN 扩展至约 1M token;官方称其在编码、办公等任务上的表现较上一代更强。
• 阿里称训练成本约为 Qwen3.7-Plus 的九分之一,API 定价为每百万 token 输入约 1 元、输出约 3 元;模型权重已同步登陆 Hugging Face、ModelScope,并提供 FP8 量化版本。
• 阿里同时发布作为下一代架构预览的 Qwen3.8-Flash-Next,默认支持百万级上下文并内置官方工具。
补充:关于“比肩 Opus 4.6”“价格为同类模型三分之一”等说法主要来自官方或相关报道,实际能力与成本仍需第三方测评验证。
2. 智谱确认“Ox Alpha”为 GLM 系列新版本,免费模型冲上榜首
• 智谱回应称,近期突然走红的 Ox Alpha 确为其 GLM 系列新一代模型,代号灵感来自近期上映的电影《牛来》。
• 该模型目前免费开放,在 OpenRouter 在线使用排行榜升至首位,使用量据称已达到 DeepSeek 的两倍以上。
• 智谱计划于今晚公开模型权重,开发者可以基于权重进行二次开发、部署和产品集成。
• Qwen3.8-Flash 与 Ox Alpha 接连采取低价或开放权重策略,意味着中国 AI 厂商正把竞争重点从单纯模型发布,推进到开发者生态、API 消耗和办公入口争夺。
3. AI 产业进入“效率验证期”,英伟达财报成为市场风向标
• 市场等待英伟达公布季度业绩,华尔街预期每股收益约 2.09 美元、营收约 922.8 亿美元。公司市值已超过 5 万亿美元,财报影响不再局限于单一芯片公司。
• 摩根士丹利预计,英伟达下一代 Rubin 平台在截至 10 月的财季可能贡献接近 90 亿美元收入,投资者将重点观察量产时间和客户采购节奏。
• 机构称,英伟达可能通过芯片涨价及与供应商锁定更有利的 2027 年供货价格,缓解内存涨价对利润率的挤压;但利润率百分比仍可能下降。
• 当前市场核心问题是 Rubin 能否扩大 AI 算力市场,还是促使客户推迟采购 Blackwell。两种情形对供应链、芯片厂商和数据中心资本开支的含义完全不同。
4. 美国 7 月 PCE 高于预期,消费动能明显降温
• 美国 7 月总体 PCE 物价指数环比上涨 0.2%、同比上涨 3.7%;核心 PCE 环比上涨 0.2%、同比上涨 3.3%,总体数据略高于市场预期。
• 7 月个人消费支出增长 0.2%,低于前值 0.3%;个人收入增长 0.4%,高于市场预期。
• 第二季度个人消费支出年化季率修正为 3.4%,核心 PCE 物价指数年化季率修正为 3.6%,均高于初值。
• 数据表明通胀下降进程仍不顺畅,而消费在夏季初的强劲增长后出现降温。债券市场承压,10 年期美债收益率一度升至约 4.671%。
补充:市场接下来关注美联储主席在杰克逊霍尔年会上的讲话,以判断其对顽固通胀和后续利率路径的态度。
5. Meta 就青少年社交媒体危害诉讼达成大额和解
• Meta 同意与美国多个州就 Facebook、Instagram 对儿童和青少年造成伤害的诉讼达成和解,金额报道存在差异,约为最高 166.8 亿美元至 180 亿美元,仍需法院批准。
• 诉方指控 Meta 通过推荐算法、通知和产品设计提高未成年人使用黏性,同时未充分告知家长并取得同意,收集 13 岁以下儿童个人数据。
• 和解安排包括未来十年支付赔偿、默认限制每日使用时间、限制夜间使用、加强年龄确认,并接受独立机构监督。
• 该协议降低了 Meta 面临极端巨额赔偿的直接风险,但并未终结来自个人、学校和其他州的诉讼;TikTok、YouTube、Snap 等平台也面临类似法律压力。
6. 日喀则吉隆县泥石流造成重大伤亡,跨境救援仍在进行
• 中国西藏日喀则市吉隆县及吉隆口岸遭遇山洪、泥石流,洪流冲入口岸区域,造成道路、电力和通信中断,多辆汽车及大巴受到冲击。
• 尼泊尔一侧拉苏瓦地区灾情严重,已报告至少 22 人死亡,仍有数百人下落不明;尼泊尔旅游部门登记有 384 名旅客失联,其中 291 人为外国公民。
• 博特科西河沿线水电项目受到影响,约 430 兆瓦发电能力受冲击,约占尼泊尔水电装机能力的 12% 以上。
• 目前“失联”名单并不等同于确认遇难,部分人员可能因通信中断无法联系。灾害成因仍在调查,研究人员推测山区冰岩崩塌或曾堵塞河道,随后形成突发溃泄。
补充:有关方面已要求全力搜救失联人员,并排查整治各类风险隐患。
7. 盖茨警告 AI 风险已越过多条安全红线
• 比尔·盖茨称,最先进 AI 模型在生物安全、网络攻击、就业冲击和心理依赖方面的风险,已达到应触发更严格安全措施的程度。
• 他尤其担心能够设计新型分子的模型被复制到缺乏监管的环境,用于研发危险病原体或生物武器,并认为行业高管私下的担忧程度高于公开表态。
• 盖茨认为,AI 正以更低成本完成大量认知工作,白领入门岗位将首先受到冲击;与过去工业革命不同,AI 可能同时进入多个行业,使劳动力转移更加困难。
• 他建议保留部分明确的人类职业,对替代人类工作的 AI 或机器人征税,并推动美国与中国围绕生物安全建立合作机制。
补充:盖茨并未否定 AI 在医疗、教育、农业和公共服务领域的价值,但认为技术进步已快于监管和社会适应能力。
8. Rockstar 回应《GTA 6》泄露,确认仍计划 11 月 19 日发售
• Rockstar Games 首次针对近期《侠盗猎车手 6》视频泄露事件公开声明,称泄露令开发团队“心碎”,并非希望玩家看到游戏的方式。
• 公司表示,游戏最终完成已接近尾声,后续仍将公布更多细节和官方 gameplay,希望玩家暂时避免受剧透影响。
• 目前公开计划的发售日期仍为 11 月 19 日。泄露事件可能影响营销节奏、社区讨论和玩家对正式体验的预期。
二、分主题深读
🤖 AI 模型、算力与开发者生态
• 模型竞争转向“低激活参数 + 长上下文”:Qwen3.8-Flash 以 125B 总参数、6B 激活参数和百万级上下文为卖点,反映 MoE 架构正在成为控制推理成本、提升吞吐量的重要路径。对于企业而言,实际调用成本、延迟和工具调用稳定性,可能比总参数量更具决定性。
• 开放权重成为扩大生态的关键手段:智谱 Ox Alpha、阿里 Qwen3.8-Flash 均强调权重开放。开放模型可降低开发者对单一 API 的依赖,但也会带来模型滥用、部署安全、版权责任和算力门槛等问题。
• 腾讯开源多模态嵌入模型:微信视觉团队发布 WeMM-Embedding,提供 2B、4B、9B 三种规格,支持文本、图像、视频、视觉文档以及混合多模态输入的表示与检索,采用 Apache 2.0 协议。模型暂不支持音频输入,但有望用于企业知识库、跨模态搜索、内容审核和文档理解。
• OpenAI 自研芯片强调能效:OpenAI 公布自研芯片 Jalapeño 的部分测试数据,称其每瓦 AI 吞吐量约为 GB200、GB300 对比系统的 1.5 至 1.9 倍,端到端延迟约为对比系统的 28% 至 59%。测试口径、工作负载和量产计划仍需进一步确认。
• 端侧机器人算力继续下沉:英伟达发布 Jetson Orin Nano 2,标准模式 AI 算力达到 78 TOPS,搭载 8 核 Arm CPU 和 8GB 内存,官方称推理能力约为前代两倍,定位更接近机器人、边缘视觉和本地智能体设备。
📱 智能体、软件与消费电子
— message 1 of 2 —