阿里智谱同日开源低价大模型,英伟达财报营收翻倍:8月末 AI 行业三件大事

阿里智谱同日开源低价大模型,英伟达财报营收翻倍:8月末 AI 行业三件大事

2026年8月26日晚,国内大模型行业迎来"双响炮":阿里巴巴发布并同步开源新一代千问模型 Qwen3.8-Flash,智谱 AI 同日上线并开源 GLM-5.3-Flash。一天之后,英伟达交出营收同比翻倍的超预期财报。三件事叠加,让"效率与价格"成为8月末 AI 行业最鲜明的注脚。

一、阿里 Qwen3.8-Flash:125B 参数只激活 6B,训练成本骤降近 90%

据中国证券报、贝壳财经等多家媒体8月26日报道,阿里发布的 Qwen3.8-Flash 采用全新下一代架构:MoE 总参数 125B,每次推理仅激活 6B,性能即超越 Claude Opus 4.6、接近 Opus 4.8。其成本优势相当直接:

指标 数据
训练成本 较 Qwen3.7-Plus 下降近 90%
API 定价(发布时) 输入 1 元 / 输出 3 元(每百万 Tokens)
API 定价(发布次日) 降至输入 0.8 元 / 输出 2.7 元
对标价格 最低仅为 DeepSeek-V4-Flash 的三分之一

架构层面,模型引入 QSA(Qwen Sparse Attention)与 GDN 混合注意力机制,在高缓存命中的百万 Token 长上下文场景下可提速 8 倍以上。智能体能力方面,Qwen3.8-Flash 在 SWE-bench Pro 编程评测中领先 Opus 4.6 达 9.1 分,在专业工作任务 JobBench 评测中超出近 20 分。同步开源的 Qwen3.8-Flash-Next 被视作下一代 Qwen4 架构的先导预览,权重已在 Hugging Face 与魔搭社区上线。

二、智谱 GLM-5.3-Flash:匿名模型"转正",国产算力承载

几乎同一时间,智谱 AI 确认此前在 OpenRouter 上引发社区热议的匿名模型 Ox-Alpha 即为 GLM-5.3-Flash,并对外开源权重。该模型是 GLM-5 系列首个原生多模态基座,总参数 320B、单 Token 激活 18B,以 MIT 协议开源,推理完全由国产芯片与基础设施承载。据腾讯新闻报道,Ox-Alpha 在 OpenRouter、OpenCode 两大平台测试期间 Token 调用量高达 62T,刷新了双平台历史纪录。资本市场给出积极回应:8月27日港股收盘,智谱全日收涨 12.62%,报 1160 港元/股,市值约 5401 亿港元。

三、英伟达 Q2 财报:营收 962 亿美元,同比翻倍

北京时间8月27日凌晨,英伟达公布 2027 财年第二财季财报:营收 962.21 亿美元,同比增长 106%、环比增长 18%,大幅超出市场预期;其中数据中心收入 890 亿美元,同比增长 117%。公司预计下季度营收约 1080 亿美元,并宣布新一代 Vera Rubin 平台已全面量产。财报发布后,英伟达盘前股价一度涨超 8%,缓解了市场对 AI 算力开支动能的担忧。

小结:Flash 路线成为新主战场

两年前行业主流仍认为 MoE 模型"落地麻烦",如今 Qwen3.8-Flash 与 GLM-5.3-Flash 的同日登场,标志着 MoE-Flash 路线从备选走向主流。参数规模不再是唯一竞赛标尺,效率、成本与落地能力正在重新定义游戏规则。对开发者和企业而言,模型选择正从"一年一选"变为"以周为单位评估"的常态化动作。

以上信息为公开报道口径,以官方为准。

← 返回博客列表