国内大模型动态:Kimi K3出海AWS分成落地,智谱FlashX涨价2.5倍,价格战转向生态战
2026年9月23日 | 大模型行业动态
2026年9月,国内大模型行业迎来密集动态。月之暗面Kimi K3正式登陆亚马逊AWS Bedrock平台,达成中国大模型首笔海外收入分成合作;智谱AI上线GLM-5.3-FlashX,推理速度提升5倍但定价上涨2.5倍,开启"以速论价"新模式;DeepSeek Flash系列API价格下调60%;阿里云百炼平台连续下调Qwen系列模型定价;MiniMax凭借M3"永久五折"策略和全模态布局持续扩张。与此同时,港股大模型板块9月23日双双走低,智谱跌超10%、MiniMax跌超5%,行业竞争逻辑正从"拼价格"转向"拼生态"。
一、Kimi K3登陆AWS Bedrock:中国大模型首笔海外分成落地
9月21日,亚马逊云科技(AWS)旗下大模型服务平台Amazon Bedrock正式接入月之暗面旗下2.8万亿参数开源大模型Kimi K3,全球企业开发者可通过平台直接调用。
核心亮点: - 这是中国大模型首次以"收入分成"模式登陆海外云平台——云厂商卖出的每一分K3调用收入,月之暗面都要分走一杯羹 - Kimi K3拥有2.8万亿参数,是中国最大的开源大模型之一 - 此前市场传言的Kimi与海外云厂商收入分成合作正式落地 - 月之暗面同步发布Kimi Code Desktop(macOS/Windows),面向开发者群体
此外,月之暗面9月11日宣布K2.8 Preview全量上线,以接近K3的能力、一半的价格补上自家模型的"性价比"缺口。据传月之暗面正在筹备港股上市。
影响与意义: Kimi K3登陆AWS标志着中国大模型出海模式从"免费开源"升级为"收费分成"。这不仅为月之暗面开辟了海外收入新通道,也为中国大模型的全球化商业化提供了可复制的范式。K2.8 Preview的低价策略和K3的高端定位形成了清晰的产品分层。
二、智谱AI上线GLM-5.3-FlashX:速度5倍,定价2.5倍
9月18日,"大模型第一股"智谱AI正式上线GLM-5.3-FlashX模型,API同步全面开放。
核心信息: - 推理速度:最高每秒200 Token,较GLM-5.3-Flash提升5倍 - 定价:提升至GLM-5.3-Flash原版的2.5倍 - 定位:被称为"神秘模型""牛来模型"的GLM-5.3-Flash升级版
此前,智谱于8月19日发布旗舰GLM-5.3,编程能力在内部Z.ai Code Bench上较GLM-5.2提升50%,在Terminal Bench 3.0等公开基准测试中达到开源模型SOTA水平,并涌现出网络安全能力。
影响与意义: 智谱的涨价策略与行业降价趋势形成鲜明对比,体现了"以速论价"的新定价逻辑——当推理速度显著提升带来实际业务价值时,更高的价格反而获得市场认可。消息公布当日智谱股价大涨近6%,但9月23日港股智谱跌超10%,显示市场对高定价策略的持续性仍存分歧。
三、DeepSeek Flash降价60%:以价换量策略持续深化
9月10日12时起,DeepSeek下调Flash系列模型API价格。
价格调整详情:
| 项目 | 调整前 | 调整后 | 降幅 |
|---|---|---|---|
| 闲时输入(缓存命中) | ¥0.05/百万词元 | ¥0.02/百万词元 | 60% |
行业背景: - 9月各厂商官网定价显示,经济型模型的输入价格普遍降至1元/百万词元左右 - 旗舰模型之间价差显著拉大:Kimi K3输入20元/百万词元、输出100元/百万词元;MiniMax M3在"永久五折"后仅2.1元/百万词元输入、8.4元/百万词元输出 - 有测算显示,同样一项典型任务,选用不同模型的成本差异可达数十倍
影响与意义: DeepSeek以60%的降幅继续引领经济型模型价格战,但行业分析指出"这一轮调价并非简单的价格竞争,而是大模型从'卖能力'走向'卖服务'的必然阶段"。价格已不再是唯一竞争维度,模型质量、服务稳定性和生态丰富度正在成为客户选择的关键因素。
四、阿里云Qwen系列多轮降价:从视觉到语音全面覆盖
阿里云大模型服务平台百炼在9月内连续进行多轮价格调整:
调价时间线:
| 时间 | 模型 | 调整内容 |
|---|---|---|
| 8月31日 | Qwen3-VL-Rerank | 文本输入:0.7元/M → 0.5元/M;多模态输入:1.8元/M → 0.5元/M |
| 9月22日 | 部分语音系列模型 | 涉及qwen-语音系列,北京和新加坡地域同步降价 |
此外,Qwen3.5 Flash目前是中国最便宜的大模型API之一,输入价格仅约0.20元/百万Token($0.030/百万Token)。Qwen3.8-27B定价为0.05元/千Token。
影响与意义: 阿里云的连续降价覆盖视觉、语音、文本等多个模态,体现了其"以低价换规模"的平台策略。作为国内最大的云服务商,阿里云正将大模型API从"高端技术产品"降维为"基础设施级服务",通过百炼平台吸引更多企业和开发者入场。
五、MiniMax M3全模态布局:企业客户突破200万
MiniMax凭借M3模型的"永久五折"策略和高性价比持续扩张市场份额。
核心数据: - M3定价(永久五折):输入2.1元/百万词元、输出8.4元/百万词元 - 7月Token消耗量较1月增长20倍 - 8月年度经常性收入(ARR)超8亿美元 - 企业客户和开发者数量突破200万,是2025年底的10倍
产品矩阵: - 大语言模型M系列:已迭代至M3,M3.1和M3 Pro在研 - 视频模型H系列:已迭代至H3 - 语音模型:已更新至Speech 2.8 - 音乐模型:已更新至Music 3.0
未来规划: 创始人闫俊杰透露,M3 Pro参数规模预计提升至约3T,搭载MSA 2.0架构,计算效率预计提升约3倍,将进一步完善强化学习和长程任务训练。
影响与意义: MiniMax是少数坚持全模态投入的中国大模型公司,其M/H/Speech/Music四条管线的协同效应正在显现。200万企业客户和8亿美元ARR的数据表明,"全模态+低价"策略正在转化为实实在在的商业回报。但9月23日港股MiniMax跌超5%,市场对其估值和盈利可持续性仍存疑虑。
国内大模型价格一览表(2026年9月)
| 厂商 | 模型 | 输入价格(每百万Token) | 输出价格(每百万Token) | 备注 |
|---|---|---|---|---|
| 月之暗面 | Kimi K3 | 20元 | 100元 | 高端旗舰 |
| 月之暗面 | K2.8 Preview | 约10元 | 约50元 | 约K3一半价格 |
| 智谱AI | GLM-5.3 | - | - | 旗舰编程模型 |
| 智谱AI | GLM-5.3-FlashX | Flash的2.5倍 | 同左 | 速度5倍提升 |
| DeepSeek | Flash(闲时缓存命中) | 0.02元 | - | 降60%后 |
| 阿里云 | Qwen3.5 Flash | 约0.20元 | - | 最经济 |
| 阿里云 | Qwen3-VL-Rerank(文本) | 0.5元 | - | 降28.6%后 |
| MiniMax | M3(永久五折) | 2.1元 | 8.4元 | 全模态布局 |
趋势总结与展望
2026年9月的国内大模型动态呈现三大趋势:
-
从价格战到生态战: DeepSeek、阿里云继续降价,但行业共识已从"拼价格"转向"拼生态"。经济型模型价格趋同后,模型质量、服务稳定性和生态丰富度成为客户选择的决定性因素。Kimi K3登陆AWS分成模式和智谱FlashX涨价2.5倍,分别代表了"出海生态"和"速度溢价"两种跳出价格内卷的新路径。
-
出海与涨价的并行: Kimi K3以收入分成模式登陆AWS开创了中国大模型出海新范式;智谱FlashX以5倍速度提升支撑2.5倍涨价——两者均表明,中国大模型正试图摆脱低价标签,向价值定价回归。
-
全模态与垂直特化并行: MiniMax的四管线(M/H/Speech/Music)全模态布局代表了一种"广覆盖"路线,而智谱GLM-5.3涌现的网络安全能力则代表了"深特化"路线。两种路线并行发展,共同推动中国大模型走向成熟。
展望未来,随着各厂商产品线日趋完善、价格体系趋于稳定,国内大模型行业将进入"拼落地"的新阶段。谁能率先在金融、医疗、政务、制造等垂直行业实现深度渗透,谁就能在下一轮竞争中占据优势。
数据来源: - 每日经济新闻、36kr、钛媒体相关报道 - 智谱AI开放平台官方文档(docs.bigmodel.cn) - 阿里云帮助中心(help.aliyun.com) - 中国经济网、证券时报、新浪财经相关报道 - 财联社快讯 - llmabacus.com中国大模型API价格对比 - 搜索日期:2026年9月23日

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论