国内大模型动态:Kimi K3出海AWS分成落地,智谱FlashX涨价2.5倍,价格战转向生态战

国内大模型动态:Kimi K3出海AWS分成落地,智谱FlashX涨价2.5倍,价格战转向生态战

Author: zhiqiu16 | Create: 2026-09-23 15:07:53 | Update: 2026-09-23 15:07:53 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

国内大模型动态:Kimi K3出海AWS分成落地,智谱FlashX涨价2.5倍,价格战转向生态战

2026年9月23日 | 大模型行业动态

2026年9月,国内大模型行业迎来密集动态。月之暗面Kimi K3正式登陆亚马逊AWS Bedrock平台,达成中国大模型首笔海外收入分成合作;智谱AI上线GLM-5.3-FlashX,推理速度提升5倍但定价上涨2.5倍,开启"以速论价"新模式;DeepSeek Flash系列API价格下调60%;阿里云百炼平台连续下调Qwen系列模型定价;MiniMax凭借M3"永久五折"策略和全模态布局持续扩张。与此同时,港股大模型板块9月23日双双走低,智谱跌超10%、MiniMax跌超5%,行业竞争逻辑正从"拼价格"转向"拼生态"。

一、Kimi K3登陆AWS Bedrock:中国大模型首笔海外分成落地

9月21日,亚马逊云科技(AWS)旗下大模型服务平台Amazon Bedrock正式接入月之暗面旗下2.8万亿参数开源大模型Kimi K3,全球企业开发者可通过平台直接调用。

核心亮点: - 这是中国大模型首次以"收入分成"模式登陆海外云平台——云厂商卖出的每一分K3调用收入,月之暗面都要分走一杯羹 - Kimi K3拥有2.8万亿参数,是中国最大的开源大模型之一 - 此前市场传言的Kimi与海外云厂商收入分成合作正式落地 - 月之暗面同步发布Kimi Code Desktop(macOS/Windows),面向开发者群体

此外,月之暗面9月11日宣布K2.8 Preview全量上线,以接近K3的能力、一半的价格补上自家模型的"性价比"缺口。据传月之暗面正在筹备港股上市。

影响与意义: Kimi K3登陆AWS标志着中国大模型出海模式从"免费开源"升级为"收费分成"。这不仅为月之暗面开辟了海外收入新通道,也为中国大模型的全球化商业化提供了可复制的范式。K2.8 Preview的低价策略和K3的高端定位形成了清晰的产品分层。

二、智谱AI上线GLM-5.3-FlashX:速度5倍,定价2.5倍

9月18日,"大模型第一股"智谱AI正式上线GLM-5.3-FlashX模型,API同步全面开放。

核心信息: - 推理速度:最高每秒200 Token,较GLM-5.3-Flash提升5倍 - 定价:提升至GLM-5.3-Flash原版的2.5倍 - 定位:被称为"神秘模型""牛来模型"的GLM-5.3-Flash升级版

此前,智谱于8月19日发布旗舰GLM-5.3,编程能力在内部Z.ai Code Bench上较GLM-5.2提升50%,在Terminal Bench 3.0等公开基准测试中达到开源模型SOTA水平,并涌现出网络安全能力。

影响与意义: 智谱的涨价策略与行业降价趋势形成鲜明对比,体现了"以速论价"的新定价逻辑——当推理速度显著提升带来实际业务价值时,更高的价格反而获得市场认可。消息公布当日智谱股价大涨近6%,但9月23日港股智谱跌超10%,显示市场对高定价策略的持续性仍存分歧。

三、DeepSeek Flash降价60%:以价换量策略持续深化

9月10日12时起,DeepSeek下调Flash系列模型API价格。

价格调整详情:

项目 调整前 调整后 降幅
闲时输入(缓存命中) ¥0.05/百万词元 ¥0.02/百万词元 60%

行业背景: - 9月各厂商官网定价显示,经济型模型的输入价格普遍降至1元/百万词元左右 - 旗舰模型之间价差显著拉大:Kimi K3输入20元/百万词元、输出100元/百万词元;MiniMax M3在"永久五折"后仅2.1元/百万词元输入、8.4元/百万词元输出 - 有测算显示,同样一项典型任务,选用不同模型的成本差异可达数十倍

影响与意义: DeepSeek以60%的降幅继续引领经济型模型价格战,但行业分析指出"这一轮调价并非简单的价格竞争,而是大模型从'卖能力'走向'卖服务'的必然阶段"。价格已不再是唯一竞争维度,模型质量、服务稳定性和生态丰富度正在成为客户选择的关键因素。

四、阿里云Qwen系列多轮降价:从视觉到语音全面覆盖

阿里云大模型服务平台百炼在9月内连续进行多轮价格调整:

调价时间线:

时间 模型 调整内容
8月31日 Qwen3-VL-Rerank 文本输入:0.7元/M → 0.5元/M;多模态输入:1.8元/M → 0.5元/M
9月22日 部分语音系列模型 涉及qwen-语音系列,北京和新加坡地域同步降价

此外,Qwen3.5 Flash目前是中国最便宜的大模型API之一,输入价格仅约0.20元/百万Token($0.030/百万Token)。Qwen3.8-27B定价为0.05元/千Token。

影响与意义: 阿里云的连续降价覆盖视觉、语音、文本等多个模态,体现了其"以低价换规模"的平台策略。作为国内最大的云服务商,阿里云正将大模型API从"高端技术产品"降维为"基础设施级服务",通过百炼平台吸引更多企业和开发者入场。

五、MiniMax M3全模态布局:企业客户突破200万

MiniMax凭借M3模型的"永久五折"策略和高性价比持续扩张市场份额。

核心数据: - M3定价(永久五折):输入2.1元/百万词元、输出8.4元/百万词元 - 7月Token消耗量较1月增长20倍 - 8月年度经常性收入(ARR)超8亿美元 - 企业客户和开发者数量突破200万,是2025年底的10倍

产品矩阵: - 大语言模型M系列:已迭代至M3,M3.1和M3 Pro在研 - 视频模型H系列:已迭代至H3 - 语音模型:已更新至Speech 2.8 - 音乐模型:已更新至Music 3.0

未来规划: 创始人闫俊杰透露,M3 Pro参数规模预计提升至约3T,搭载MSA 2.0架构,计算效率预计提升约3倍,将进一步完善强化学习和长程任务训练。

影响与意义: MiniMax是少数坚持全模态投入的中国大模型公司,其M/H/Speech/Music四条管线的协同效应正在显现。200万企业客户和8亿美元ARR的数据表明,"全模态+低价"策略正在转化为实实在在的商业回报。但9月23日港股MiniMax跌超5%,市场对其估值和盈利可持续性仍存疑虑。

国内大模型价格一览表(2026年9月)

厂商 模型 输入价格(每百万Token) 输出价格(每百万Token) 备注
月之暗面 Kimi K3 20元 100元 高端旗舰
月之暗面 K2.8 Preview 约10元 约50元 约K3一半价格
智谱AI GLM-5.3 - - 旗舰编程模型
智谱AI GLM-5.3-FlashX Flash的2.5倍 同左 速度5倍提升
DeepSeek Flash(闲时缓存命中) 0.02元 - 降60%后
阿里云 Qwen3.5 Flash 约0.20元 - 最经济
阿里云 Qwen3-VL-Rerank(文本) 0.5元 - 降28.6%后
MiniMax M3(永久五折) 2.1元 8.4元 全模态布局

趋势总结与展望

2026年9月的国内大模型动态呈现三大趋势:

  1. 从价格战到生态战: DeepSeek、阿里云继续降价,但行业共识已从"拼价格"转向"拼生态"。经济型模型价格趋同后,模型质量、服务稳定性和生态丰富度成为客户选择的决定性因素。Kimi K3登陆AWS分成模式和智谱FlashX涨价2.5倍,分别代表了"出海生态"和"速度溢价"两种跳出价格内卷的新路径。

  2. 出海与涨价的并行: Kimi K3以收入分成模式登陆AWS开创了中国大模型出海新范式;智谱FlashX以5倍速度提升支撑2.5倍涨价——两者均表明,中国大模型正试图摆脱低价标签,向价值定价回归。

  3. 全模态与垂直特化并行: MiniMax的四管线(M/H/Speech/Music)全模态布局代表了一种"广覆盖"路线,而智谱GLM-5.3涌现的网络安全能力则代表了"深特化"路线。两种路线并行发展,共同推动中国大模型走向成熟。

展望未来,随着各厂商产品线日趋完善、价格体系趋于稳定,国内大模型行业将进入"拼落地"的新阶段。谁能率先在金融、医疗、政务、制造等垂直行业实现深度渗透,谁就能在下一轮竞争中占据优势。


数据来源: - 每日经济新闻、36kr、钛媒体相关报道 - 智谱AI开放平台官方文档(docs.bigmodel.cn) - 阿里云帮助中心(help.aliyun.com) - 中国经济网、证券时报、新浪财经相关报道 - 财联社快讯 - llmabacus.com中国大模型API价格对比 - 搜索日期:2026年9月23日

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.