国内大模型最新动态与价格变化(2026年9月20日)
一、行业总览
2026年9月,国内大模型市场持续活跃,月之暗面、阿里通义、智谱 AI、MiniMax 等头部厂商在模型发布、API 定价和生态布局上各有动作。本月最值得关注的是 Kimi K3 以「全球首个开源 3 万亿级别模型」的姿态强势登场,以及 Qwen3.5-Omni-Plus 在全模态能力上的升级。与此同时,国内大模型 API 价格体系日益透明,各家在不同定位的模型上形成了清晰的价格梯度。本文整理了近期 5 条最重要的国内大模型动态,并附详细价格对比。
二、重点动态
1. Kimi K3 正式发布——全球首个开源 3 万亿级别模型
- 发布方/来源:月之暗面(Moonshot AI)
- 核心亮点:
- Kimi K3 是月之暗面最新旗舰模型,也是全球首个开源的 3 万亿级别模型
- 支持 1,000,000 tokens(1M)超长上下文,最大输出同样达到 1M
- 面向长程编程、知识工作和推理等前沿智能场景设计
- 在开放平台完成充值(最低 10 元)后即可解锁调用
- API 定价:
| 计费项 | 价格(元/百万 tokens) |
|---|---|
| 推理输入 | ¥20.00 |
| 推理输出 | ¥100.00 |
| 缓存命中 | ¥2.00 |
| 缓存写入 | ¥25.00 |
- 影响与意义:K3 的发布标志着国内大模型在参数规模和上下文长度上已进入全球第一梯队。3 万亿参数 + 1M 上下文的组合,使其在处理超长文档分析、大规模代码库理解和复杂知识推理时具有独特优势。不过,输出价格 ¥100/MTok 定位高端,主要面向企业级应用和高价值场景。
2. Kimi K2.8 Preview 与 K2.7 Code 同步开放——性价比之选
- 发布方/来源:月之暗面(Moonshot AI)
- 核心亮点:
- Kimi K2.8 Preview:综合性能接近 K3,思考(thinking)效率更高,支持 thinking effort 档位调节,支持 1M 超长上下文
- Kimi K2.7 Code:专为编程场景优化,在长上下文中更可靠地遵循指令,支持 256k tokens 上下文窗口
- K2.7 Code 提供高速版本,以更高价格换取更低延迟
- API 定价对比:
| 模型 | 推理输入(元/MTok) | 推理输出(元/MTok) | 缓存命中(元/MTok) | 上下文 |
|---|---|---|---|---|
| Kimi K3 | ¥20 | ¥100 | ¥2 | 1M |
| Kimi K2.8 Preview | ¥6.5 | ¥27 | ¥1.7 | 1M |
| Kimi K2.7 Code | ¥6.5 | ¥27 | ¥1.3 | 256k |
| Kimi K2.7 Code HighSpeed | ¥13 | ¥54 | ¥2.6 | 256k |
- 影响与意义:K2.8 Preview 以 K3 约 1/3 的价格提供了接近旗舰的性能,是大多数开发者和企业的理性选择。K2.7 Code 则进一步细化了编程场景的服务能力,高速版本满足了对延迟敏感的生产环境需求。月之暗面通过清晰的产品矩阵,实现了从高端到性价比市场的全覆盖。
3. Qwen3.5-Omni-Plus 升级——全模态能力再进化
- 发布方/来源:阿里云(通义千问)
- 更新时间:2026年9月18日
- 核心亮点:
- Qwen3.5-Omni-Plus 是 Qwen 全模态大模型的全面进化版本
- 支持文本、图片、音频、音视频理解与交互
- 支持超过 10 小时的音频理解及超过 400 秒的 720P 视频理解
- 相比 Qwen3-Omni 在模态融合和理解精度上有显著提升
- 影响与意义:在多模态成为大模型必争之地的背景下,Qwen3.5-Omni-Plus 的升级使阿里云在音视频内容理解、智能客服、媒体处理等场景具备了更强的竞争力。9月18日的更新时间也显示出阿里云在产品迭代上的高频节奏。此外,阿里云百炼平台已上线 qwen3.5-122b-a10b 和 qwen3.5-35b-a3b 等模型的训练与部署服务,进一步完善了模型即服务(MaaS)生态。
4. MiniMax M2.5 上线——强化学习驱动的开源旗舰
- 发布方/来源:MiniMax
- 更新时间:2026年9月19日
- 核心亮点:
- MiniMax-M2.5 是 MiniMax 推出的旗舰级开源大模型
- 经过数十万个真实复杂环境中的大规模强化学习训练
- 在编程、工具调用和搜索、办公等生产力场景达到或刷新行业 SOTA
- API 定价:
| 计费项 | 价格(元/百万 tokens) |
|---|---|
| 推理输入 | ¥2.10 |
| 推理输出 | ¥8.40 |
- 影响与意义:MiniMax M2.5 以极具竞争力的价格(输入仅 ¥2.1/MTok)提供了旗舰级能力,对中小开发者和初创企业具有强大吸引力。值得注意的是,MiniMax 2026 年上半年营收达 7.86 亿元,同比增长超过 100%,但销售费用不增反降,展现出良好的商业化效率。开源策略 + 低成本 API 的组合,可能使 MiniMax 在国内大模型市场中走出一条差异化道路。
5. 智谱 GLM-5.3 系列价格体系确立,营收增长与销售费用下降并存
- 发布方/来源:智谱 AI(Zhipu AI)
- 核心亮点:
- GLM-5.3 系列形成清晰的价格梯度,覆盖从极致性价比到高端全能力的全场景
- 智谱 2026 年上半年营收 9.54 亿元,同比增长 399.7%
- 销售及营销开支同比缩减 14.8% 至 1.78 亿元,实现「增收减支」
- GLM-5.3 系列 API 定价:
| 模型名称 | 推理输入(元/MTok) | 推理输出(元/MTok) | 缓存命中(元/MTok) |
|---|---|---|---|
| GLM-5.3 | ¥8 | ¥28 | ¥2 |
| GLM-5.3-Flash | ¥0.8 | ¥2.8 | ¥0.23 |
| GLM-5.3-FlashX | ¥2 | ¥7 | ¥0.57 |
- 影响与意义:GLM-5.3-Flash 以 ¥0.8/MTok 的输入价格,成为当前国内主流大模型中性价比最高的选择之一,非常适合高频调用、成本敏感的泛化场景。智谱「营收暴增、销售费用下降」的财务表现,说明其产品力和品牌认知度已进入正循环,市场开始主动选择智谱的产品而非依赖大量营销投入。
三、国内主流模型价格横向对比
为便于读者直观了解当前市场格局,以下汇总了各厂商主力模型的 API 定价对比:
| 厂商 | 模型 | 输入(元/MTok) | 输出(元/MTok) | 定位 |
|---|---|---|---|---|
| 月之暗面 | Kimi K3 | ¥20 | ¥100 | 开源旗舰 / 超长上下文 |
| 月之暗面 | Kimi K2.8 Preview | ¥6.5 | ¥27 | 高性价比旗舰 |
| 月之暗面 | Kimi K2.7 Code | ¥6.5 | ¥27 | 编程专用 |
| 智谱 AI | GLM-5.3 | ¥8 | ¥28 | 高端全能力 |
| 智谱 AI | GLM-5.3-FlashX | ¥2 | ¥7 | 均衡性价比 |
| 智谱 AI | GLM-5.3-Flash | ¥0.8 | ¥2.8 | 极致性价比 |
| MiniMax | MiniMax-M2.5 | ¥2.1 | ¥8.4 | 开源旗舰 |
从价格对比可以看出,国内大模型市场已形成明确的分层:GLM-5.3-Flash 主打极致低价,MiniMax-M2.5 和 GLM-5.3-FlashX 主打均衡性价比,Kimi K2.8 Preview 和 GLM-5.3 主打高性能,Kimi K3 则以超大参数和超长上下文占据高端定位。
四、趋势总结与展望
2026年9月国内大模型市场呈现以下趋势:
-
「开源 + 大参数」成为新竞争高地:Kimi K3 以 3 万亿参数开源的魄力,将国内开源大模型的天花板大幅推高。未来,参数规模与开源策略的结合将成为争夺开发者生态的关键武器。
-
价格分层日趋清晰:从 ¥0.8/MTok 到 ¥100/MTok,国内大模型已形成覆盖全场景的价格体系。企业客户可以根据业务需求灵活选择,API 价格战已从「全面降价」进入「精准分层」阶段。
-
商业化效率开始分化:智谱和 MiniMax 均实现了营收翻倍增长而销售费用下降,说明市场开始认可头部厂商的产品价值。未来不具备核心技术优势的厂商将面临更大压力。
展望未来,随着 Kimi K3 生态的建设、Qwen 多模态能力的持续进化,以及 GLM 和 MiniMax 在性价比市场的深耕,国内大模型市场将在第四季度迎来更加激烈的竞争格局。对于开发者和企业而言,当前正是评估和选型大模型方案的最佳窗口期。
数据来源
本文信息综合整理自以下公开来源: - Kimi API 开放平台官方定价 $TRAE_REF - 阿里云百炼平台模型文档 $TRAE_REF - 腾讯云 TokenHub 模型价格 $TRAE_REF - GpuGeek 模型市场 $TRAE_REF - 蓝鲸新闻关于智谱、MiniMax 财报报道 $TRAE_REF - 硅基流动模型中心 $TRAE_REF - 360 智脑开放平台 $TRAE_REF
数据采集时间:2026年9月20日

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论