总览
2026年9月初,国内大模型市场持续升温。阿里通义千问在发布仅一个月后即推出Qwen3.8-Max升级版本,月之暗面的Kimi K3以2.8万亿参数和百万级上下文窗口持续引领长文本赛道,MiniMax通过大幅降价抢占市场份额,而智谱AI则走出了一条"结构性涨价"的独特路线。本文梳理国内主流厂商的最新动态,重点关注模型更新与价格变化,帮助开发者和企业用户做出更明智的选择。
一、阿里 Qwen3.8-Max 升级至 0902 版本:一个月两次迭代
发布方:阿里巴巴通义千问团队
发布时间:2026年9月2日
距离8月初发布并开源Qwen3.8-Max仅一个月,阿里迅速推出了0902升级版本。这在国产大模型的迭代速度中堪称罕见。
核心亮点: - 编程能力显著提升:在专门评估AI独立交付完整前端应用能力的CodeArena榜单上,Qwen3.8-Max的得分提高至1691分,排名紧追Claude Opus 5和Kimi K系列。 - 更适合企业复杂任务:官方表示,0902版本在企业真实复杂任务、科研场景和长周期任务中的表现均有优化。 - 开源生态持续扩大:作为少数坚持开源路线的国内顶级模型,Qwen3.8-Max的社区生态正在快速成熟。
影响与意义: 阿里以"摩尔定律"般的迭代速度展示了对大模型赛道的决心。一个月内的两次重大更新不仅体现了技术团队的工程能力,也表明Qwen系列正在积极吸收企业用户的反馈,朝着"更实用、更落地"的方向演进。对于依赖开源模型的中小企业和开发者而言,Qwen的持续进化提供了一个高性价比的选择。
二、Kimi K3:2.8万亿参数 + 百万上下文,长文本赛道持续领跑
发布方:月之暗面(Moonshot AI)
发布时间:2026年7月17日(持续迭代中)
虽然Kimi K3发布于7月,但截至9月它仍是国内大模型市场最受关注的旗舰产品之一,其在各大云平台的接入和价格策略持续引发讨论。
核心亮点: - 超大参数规模:K3拥有2.8万亿参数,基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差技术构建。 - 原生多模态 + 百万上下文:原生支持视觉理解,拥有100万token的上下文窗口,在长文档分析、视频理解等场景中优势明显。 - 前端代码能力突出:在前端代码竞技中以76%的胜率和1679的得分位居榜首。 - 全球排名靠前:官方宣称整体表现仅次于Claude Fable 5和GPT-5.6 Sol,超过其他所有模型。
价格情况:
| 项目 | 价格(元/百万token) |
|---|---|
| 缓存输入 | 2 |
| 非缓存输入 | 20 |
| 输出 | 100 |
K3的公开定价在Kimi官方、阿里云百炼与七牛云等平台采用相同口径,但部分渠道可能通过阶梯折扣提供更低价格。
影响与意义: Kimi K3代表了国内大模型在"长文本+多模态"方向的技术高峰。100万token的上下文窗口使其在法律、金融、科研等需要处理海量文档的场景中具有不可替代的优势。不过,每百万token输出100元的定价也使其成为国产模型中价格最高的选择之一,更适合对性能敏感、预算充足的企业客户。
三、MiniMax-M3 价格大幅下调 50%:以价换量抢占市场
发布方:MiniMax / 腾讯云TokenHub、云开发CloudBase
生效时间:2026年6月-7月陆续生效
MiniMax在年中对其旗舰模型M3进行了大幅降价,这一策略被市场解读为"以价换量"的积极进攻。
价格调整前后对比:
| 项目 | 调整前(元/百万token) | 调整后(元/百万token) | 降幅 |
|---|---|---|---|
| 推理输入 | 8.4 | 4.2 | 50% |
| 推理输出 | 33.6 | 16.8 | 50% |
| 缓存命中 | 1.68 | 0.84 | 50% |
影响与意义: MiniMax的降价力度在国内头部厂商中属于最大一档。50%的降幅直接将其推入了"性价比优先"的竞争阵营。对于开发者而言,这意味着在构建AI应用时可以用更低的成本获得接近顶级模型的能力。从市场策略来看,MiniMax可能正在通过牺牲短期利润来快速扩大用户基数和市场份额,这种打法在云计算和SaaS领域已被多次验证。
四、智谱 AI GLM-5:年内三轮涨价,走差异化高端路线
发布方:智谱AI
与国际厂商降价、国内同行跟进的趋势相反,智谱AI在2026年走出了一条"结构性涨价"的路线。
价格调整时间线:
| 时间 | 调整内容 | 涨幅 |
|---|---|---|
| 2026年2月 | GLM Coding Plan 结构性调价 | 上调 |
| 2026年3月 | GLM-5-Turbo 发布 | API价格上调20% |
| 2026年4月 | GLM-5.1 发布 | API价格再度上调10% |
核心亮点: - GLM-5.1持续迭代:模型能力稳步提升,在中文理解和编程场景中保持竞争力。 - Coding Plan套餐焕新:2026年7月30日推出新版积分制套餐,以Token消耗为基础,提升额度计算的透明度。 - 企业级定位明确:涨价策略表明智谱更倾向于服务对价格不敏感、对性能和稳定性要求更高的企业客户。
影响与意义: 智谱的涨价策略在"降价潮"中显得尤为特立独行。这一定价行为可能基于两点判断:一是GLM系列在中文场景中的差异化优势足以支撑溢价;二是企业客户更关注模型的可靠性和服务品质,而非单纯的价格。然而,持续涨价也可能导致部分价格敏感型用户流向Qwen、MiniMax等竞品,智谱需要在"高端定位"与"市场份额"之间找到新的平衡点。
五、国内大模型价格格局一览
以下是截至2026年9月,国内主流旗舰模型的API价格对比:
| 厂商 | 代表模型 | 输入价格(元/百万token) | 输出价格(元/百万token) | 备注 |
|---|---|---|---|---|
| 月之暗面 | Kimi K3 | 20(非缓存)/ 2(缓存) | 100 | 百万上下文 |
| 阿里 | Qwen3.8-Max | 按平台定价 | 按平台定价 | 开源 |
| MiniMax | MiniMax-M3 | 4.2 | 16.8 | 降价后 |
| 智谱AI | GLM-5.1 | 结构性上调后 | 结构性上调后 | 高端定位 |
注:部分模型在不同云平台(阿里云百炼、腾讯云TokenHub、火山引擎等)的定价可能存在差异,上表为参考口径。
趋势总结与展望
从本周国内大模型动态可以看出三个趋势:
-
迭代速度成为新战场:阿里一个月内两次更新旗舰模型,表明国内头部厂商已进入"快速迭代、小步快跑"的节奏。未来模型的发布周期可能从季度级缩短至月度级。
-
价格策略分化明显:MiniMax选择降价换量,智谱选择涨价提质,阿里和Kimi则保持稳健。这种分化反映了各家厂商在市场定位上的差异——有的追求规模,有的追求利润,有的追求生态。
-
长文本与代码能力成核心竞争力:Kimi的百万上下文和Qwen在CodeArena上的高分都说明,"能处理多长"和"代码写得多好"已成为企业选型的两大硬指标。未来围绕这两个维度的竞争将愈发激烈。
展望未来,随着国内大模型在性能上逐渐逼近国际顶尖水平,竞争焦点将从"追平"转向"差异化"——谁能更好地理解中文语境、谁能在特定垂直场景中提供更优的解决方案、谁能构建更健康的开发者生态,谁就能在下一轮洗牌中占据有利位置。
数据来源
- 阿里云百炼模型帮助中心(Kimi K3、Qwen3.8-Max官方文档,2026年9月)
- 阿里研究院公众号(Qwen3.8-Max升级公告,2026年9月2日)
- 腾讯云TokenHub / 云开发CloudBase(MiniMax-M3降价公告,2026年6月-7月)
- 智谱AI开放文档(GLM Coding Plan套餐说明,2026年7月30日)
- CSDN、界面新闻、新浪财经等科技媒体报道(2026年7月-9月)
- LLMRates.ai 大模型价格行情平台(2026年9月)
本文整理于 2026年9月3日,价格与模型信息可能随时调整,建议以各厂商官方渠道最新公告为准。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论