国内大模型动态日报(2026年9月1日)

国内大模型动态日报(2026年9月1日)

Author: zhiqiu16 | Create: 2026-09-01 15:08:30 | Update: 2026-09-01 15:08:30 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

国内大模型动态日报(2026年9月1日)

总览

国内大模型行业在 8 月呈现出明显的"涨价潮"与"效率竞赛"双重格局。月之暗面 Kimi K3 将输出价格推至百万 token 100 元,较前代涨超 3.5 倍;与此同时,阿里通义千问 Qwen3.8-Flash 以仅激活 60 亿参数超越 Claude Opus 4.6 的性能,训练成本骤降近 90%,定价仅为 1 元/百万 tokens 输入。智谱 AI 推出 GLM-5.3-Flash,MiniMax 的 H3 系列登陆 Vercel 并限时五折。以下是本期四大核心动态。


一、Kimi K3 引领涨价潮,月之暗面完成新一轮融资

发布方:月之暗面(Moonshot AI)
时间:2026 年 7 月 17 日发布,8 月持续发酵
核心亮点

  • Kimi K3 是月之暗面迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差技术构建,是全球首个开源的 3T 级别模型,原生支持视觉理解,拥有 100 万 token 上下文窗口。
  • API 定价大幅上调:非缓存输入 $3.00/百万 tokens,输出 $15.00/百万 tokens(约合人民币 100 元),缓存命中输入 $0.30/百万 tokens。较 K2.6 的 27 元/百万 tokens 输出价,涨幅超过 3.5 倍。
  • Kimi Token Plan 会员订阅同步调整:Andante ¥39/月起,Allegro ¥559/月解锁百万 Tokens 超长对话,年付最高省 ¥1,680。
  • 8 月消息显示,K3 发布后月之暗面将完成新一轮融资,投资方包括阿里云灵骏、摩尔线程、海光 DCU 等国产算力平台。

影响与意义:Kimi K3 的涨价标志着国产大模型从"烧钱换市场"向"价值定价"转型。作为首个开源 3T 级模型,K3 在技术层面树立了标杆,但 3.5 倍的涨幅也引发了市场对国产模型定价权的广泛讨论。与此同时,DeepSeek 也在 8 月预告 API 将"近期整体涨价,预计涨幅较大",表明涨价已成为行业趋势。


二、阿里通义千问:Qwen3.8-Flash 效率革命,6B 激活超越 Opus 4.6

发布方:阿里云通义千问
时间:2026 年 8 月 26 日
核心亮点

  • 8 月 26 日,阿里发布并同步开源 Qwen3.8-Flash,采用全新下一代架构,千亿总参数仅激活 60 亿(6B)即可获得超越 Claude Opus 4.6 的前沿性能,创下模型效率的全球新基准。
  • 训练成本较 Qwen3.7-Plus 骤降近 90%,API 定价为输入 1 元/百万 tokens、输出 3 元/百万 tokens,仅为 Claude Opus 4.6 的 3%。
  • 同期发布的旗舰系列 Qwen3.8-2.4T-A95B 采用稀疏 MoE 架构,总参数 2.4 万亿,每步激活约 95B。Qwen3.8-Max 国内定价为输入 12 元/百万 tokens、输出 36 元/百万 tokens,缓存命中 1.5 元/百万 tokens。
  • Qwen3.8-Flash 权重在 Hugging Face 与魔搭社区同步开源,发布 FP8 量化版本,SGLang/vLLM 首日支持。

影响与意义:Qwen3.8-Flash 以极致效率和白菜价定位,直接对标国际一线模型性能,展示了阿里在模型架构创新上的深厚积累。"6B 激活超越 Opus 4.6"这一数据极具冲击力,也意味着中小企业和开发者可以以极低成本获得接近前沿水平的 AI 能力。Qwen 系列的表现再次证明,MoE 稀疏架构是国产模型实现"弯道超车"的关键技术路径。

价格对比表

模型 输入价格(元/百万 tokens) 输出价格(元/百万 tokens) 备注
Kimi K3 ~20 ~100 缓存命中输入 ~2 元
Qwen3.8-Flash 1 3 仅 6B 激活,效率基准
Qwen3.8-Max 12 36 缓存命中 1.5 元
DeepSeek(待涨价) 待公布 待公布 8 月 11 日预告涨价
GLM-5.2 ~10 ~30 5.3-Flash 为 1/10 价

三、智谱 AI:GLM-5.3-Flash 发布,开源矩阵持续扩展

发布方:智谱 AI
时间:2026 年 8 月
核心亮点

  • GLM-5.3-Flash 正式发布,在各项基准测试和实际使用中全面超越参数量高出一倍的 GLM-5.2,定价仅为后者的 1/10,限时折扣内为 GLM-5.3 的 1/20,为 Claude Opus 4.8 的 1/40。
  • 智谱同步推出 GLM 开源新矩阵,覆盖 9B/32B 等规格,配合 Z.ai 平台提供免费体验入口。
  • 7 月 30 日,GLM Coding Plan 套餐焕新上线,新版采用以 Token 消耗为基础的积分制,提升额度计算的透明度和可预期性。
  • GLM-4.5 Flash / GLM-4.7 Flash API 仍保持免费,面向轻量级开发场景。

影响与意义:智谱 AI 的"开源 + 商业"双轨策略日趋成熟。GLM-5.3-Flash 以极致性价比冲击市场,同时通过 Coding Plan 积分制锁定开发者黏性。免费 API 的持续提供则降低了 AI 应用的入门门槛,有助于培育生态。


四、MiniMax:H3 系列登陆 Vercel,音乐 API 战略收缩

发布方:MiniMax
时间:2026 年 8 月
核心亮点

  • MiniMax H3 和 H3 Max 模型上线 Vercel 平台,用户可通过 AI Gateway 调用。9 月 13 日前享受 50% 折扣,使用 generateVideo 接口可直接调用 minimax/minimax-h3-max 模型。
  • MiniMax M2.7 当前按量计费定价为输入 $0.3/百万 tokens、输出 $1.2/百万 tokens,高速版翻倍。M3 模型在 6 月上线初期因从按次计费改为按 Token 计费引发用户不满,随后在腾讯云平台下调 50% 价格。
  • 8 月 20 日起,MiniMax 音乐生成付费接口不再向新用户开放,免费音乐生成接口(Music-3.0-free 等)停止服务,音乐能力聚焦至 MiniMax Audio 平台和 Hugging Face 发布。
  • MiniMax 管理层在业绩会上表示,M3 调价导致的毛利率下降是一次性因素,下半年毛利率将有所回升。

影响与意义:MiniMax 正在经历从"全面铺开"到"聚焦核心"的战略调整。音乐 API 的收缩表明公司在非核心业务上的止损,而 H3 系列登陆 Vercel 则显示了其向国际化开发者生态靠拢的决心。M3 定价风波的经验教训,也提醒整个行业:价格调整策略需要更透明的用户沟通。


趋势总结与展望

  1. 涨价潮与效率革命并行:以 Kimi K3 为代表的高端模型大幅涨价,以 Qwen3.8-Flash 为代表的高效模型则进一步压低入门成本。国产大模型市场正在分层:高端模型追求"质"的突破,高效模型追求"量"的覆盖。
  2. MoE 架构成为国产模型标配:Qwen3.8 系列、Kimi K3 均采用 MoE/稀疏激活架构,以较少计算量实现更大模型容量,这已成为国产模型技术路线的重要共识。
  3. 开源生态加速成熟:Kimi K3 作为首个开源 3T 模型、Qwen3.8-Flash 首日开源、智谱开源矩阵扩展——国产模型在开源领域的投入力度持续加大,有望构建更丰富的开发者生态。
  4. 定价权博弈进入深水区:Kimi 领涨、DeepSeek 预告涨价,但 Qwen 和智谱以低价策略对冲,市场定价呈现两极分化。下半年谁能在价格与性能之间找到最优平衡,将决定市场份额的走向。

数据来源:月之暗面官方论坛、阿里云百炼平台文档、智谱 AI 开放文档、MiniMax 开放平台、腾讯云公告、华福证券、21 世纪经济报道、36 氪、IT 之家、澎湃新闻。信息采集时间:2026 年 8 月 25 日至 9 月 1 日。

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.