总览
2026年9月,国内大模型市场持续升温,价格战与能力升级双线并行。智谱AI推出GLM-5.3-Flash并以限时5折的激进定价杀入市场,Kimi K3凭借2.8万亿参数和1M上下文继续领跑国产旗舰,通义千问Qwen系列稳步迭代,MiniMax则通过降价进一步提升性价比。本期动态将聚焦国内大模型行业的最新变化,重点关注价格调整趋势和各厂商的战略布局。
一、智谱GLM-5.3-Flash:限时5折+夜间免费,价格战再升级
事件概况
- 发布时间:2026年8月底上线,限时优惠持续至9月9日
- 发布方:智谱AI
- 产品定位:高性价比Flash级大模型
核心亮点
- 限时半价优惠:GLM-5.3-Flash上线后推出两周限时半价,缓存未命中输入0.4元/百万token、输出1.4元/百万token,缓存命中输入0.115元/百万token,优惠持续至2026年9月9日24时。
- 夜间免费活动:9月3日至9月20日期间,每晚23:00至次日9:00,所有付费套餐用户可免费使用GLM-5.3-Flash,系统自动生效,无需手动开启。
- 价格对标与超越:标准价输入0.8元、输出2.8元/百万token,限时折扣后仅为GLM-5.3旗舰版价格的1/20,约为Claude Opus 4.8的1/40。
- 开源发布:GLM-5.3-Flash已正式开源,权重可在HuggingFace/GitHub获取,开发者可自由部署和二次开发。
- Coding Plan天猫上架:智谱在天猫开设官方店铺售卖Token套餐,个人版Lite月付118元(含10000积分)、Pro月付538元(含60000积分)、Max月付1078元(含140000积分);团队版标准席位月付598元(含66000积分)。
价格对比表
| 计费项 | GLM-5.3-Flash 标准价 | GLM-5.3-Flash 限时5折价 | GLM-5.3 旗舰版 | Claude Opus 4.8(参考) |
|---|---|---|---|---|
| 输入(元/百万token) | 0.8 | 0.4 | 8.0 | ~35 |
| 输出(元/百万token) | 2.8 | 1.4 | 28.0 | ~120 |
| 缓存命中(元/百万token) | 0.23 | 0.115 | - | - |
影响与意义
智谱以"腰斩价+夜间免费"的组合拳强势切入性价比市场,直接对标DeepSeek等头部厂商的定价策略。开源+低价的组合有望快速扩大开发者生态,提升市场份额。对于用户而言,短期是利好——可以用极低的成本体验前沿模型能力;但长期来看,需要关注限时优惠结束后的定价策略是否可持续。
二、Kimi K3:2.8万亿参数旗舰,国产最强编程模型
事件概况
- 发布时间:2026年7月正式发布,9月持续生态扩展
- 发布方:月之暗面(Moonshot AI)
- 产品定位:国产旗舰级通用大模型
核心亮点
- 参数规模领先:Kimi K3拥有约2.8万亿参数,是全球首个开源的3万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景设计。
- 超长上下文:支持1,048,576(1M)token上下文窗口,最大输出100万token,可一次性处理整本书或大型代码库。
- API定价:国际版API价格为Cache命中输入$0.30、Cache未命中输入$3.00、输出$15.00(每百万token);国内版约为输入¥20、输出¥100(每百万token),缓存写入¥25、缓存读取¥2。
- Kimi Code编程能力:基于旗舰K3模型,搭载K2.7 Code普速版与High Speed高速版双模式,最高推理速度260 Tokens/s,全面兼容Kimi Code CLI、Claude Code、VS Code等主流Agent工具。
- 订阅套餐体系:提供Andante(¥49/月)、Allegro等多档套餐,K3支持1M上下文(Allegro及以上),Agent任务可并行1-4个。
价格对比表(API)
| 计费项 | Kimi K3 国际版(美元/百万token) | Kimi K3 国内版(人民币/百万token) |
|---|---|---|
| 缓存命中输入 | $0.30 | ¥2 |
| 缓存未命中输入 | $3.00 | ¥20 |
| 输出 | $15.00 | ¥100 |
| 缓存写入 | - | ¥25 |
| 上下文窗口 | 1M tokens | 1M tokens |
影响与意义
Kimi K3代表了国产大模型的第一梯队水平,2.8万亿参数规模在开源模型中处于领先地位。其在编程和长文档处理领域的突出表现,正在吸引越来越多的企业开发者。月之暗面通过开源权重+商业API的双轨模式,在技术影响力和商业变现之间寻求平衡。对于国内开发者而言,K3提供了一个可以与国际顶级模型对标的本土选择。
三、通义千问Qwen系列:稳步迭代,生态持续完善
事件概况
- 最新动态:Qwen3.7-Plus于2026年5月发布,Flash系列持续优化
- 发布方:阿里云·通义千问
- 产品定位:全栈式大模型产品线
核心亮点
- 旗舰模型稳步升级:Qwen3.7-Plus-2026-05-26支持256K上下文,后付费输入¥4.8/10K TPM/小时、输出¥1.92/1K TPM/小时;预付费输入¥57.6/10K TPM/天、输出¥23.04/1K TPM/天。
- Flash系列高性价比:Qwen-Flash 0-256K区间输入仅$0.05/百万token,输出$0.40/百万token;256K-1M区间输入$0.25、输出$2.00,是入门级场景的性价比之选。
- 多模态能力拓展:通义Embedding Vision Plus等多模态模型持续更新,支持图片、视频和文本输入,按输入Token计费。
- 企业级生态完善:依托阿里云基础设施,提供从模型训练、部署到应用开发的全链路服务,百炼(Model Studio)平台支持多种模型部署方案。
价格对比表
| 模型 | 上下文窗口 | 输入价格 | 输出价格 | 定位 |
|---|---|---|---|---|
| Qwen3.7-Plus | 256K | ¥4.8/10K TPM/小时(后付费) | ¥1.92/1K TPM/小时(后付费) | 旗舰通用 |
| Qwen-Flash(0-256K) | 256K | $0.05/百万token | $0.40/百万token | 轻量高速 |
| Qwen-Flash(256K-1M) | 1M | $0.25/百万token | $2.00/百万token | 长文本轻量 |
| Qwen-Plus(256K-1M) | 1M | $1.20/百万token | $3.60/百万token | 高性能 |
影响与意义
通义千问凭借阿里云的基础设施优势,构建了最完整的国产大模型产品矩阵。从超低成本的Flash到高性能的Plus系列,覆盖了几乎所有应用场景。对于企业用户而言,选择通义意味着可以在一个平台上完成从开发到部署的全流程,降低技术对接成本。Qwen的开源权重也在社区中拥有广泛影响力,是国产大模型生态的重要支柱。
四、MiniMax-M3:价格下调50%,性价比持续提升
事件概况
- 调整时间:2026年6月15日起生效
- 发布方:MiniMax(稀宇科技)
- 产品定位:多模态大模型
核心亮点
- 全面降价50%:推理输入、推理输出及缓存命中费用均下调50%,降价后输入2.1元/百万token、输出8.4元/百万token、缓存命中0.42元/百万token(输入长度0-512k区间)。
- 512K长上下文:MiniMax-M3支持512K token上下文窗口,可处理长篇文档、多轮对话等复杂场景。
- 多模态能力:支持文本、图像、语音等多种模态,在创意生成、内容创作等领域有特色表现。
- 多平台接入:已接入腾讯云TokenHub等多个云平台,用户可通过多种渠道调用。
价格对比表
| 计费项 | 调整前(元/百万token) | 调整后(元/百万token) | 降幅 |
|---|---|---|---|
| 推理输入(0-512k) | 4.2 | 2.1 | 50% |
| 推理输出(0-512k) | 16.8 | 8.4 | 50% |
| 缓存命中(0-512k) | 0.84 | 0.42 | 50% |
影响与意义
MiniMax-M3的半价调整是2026年国内大模型价格战的一个缩影。随着训练和推理成本的下降,以及市场竞争的加剧,各厂商纷纷通过降价来争夺客户。对于中小开发者和创业公司来说,价格下降意味着AI应用的开发门槛进一步降低,可以用更低的成本验证商业想法。
趋势总结与展望
核心趋势
- 价格战进入白热化阶段:智谱限时5折、MiniMax降价50%、Qwen-Flash低至0.05美元……国内大模型市场的价格竞争愈演愈烈,用户端的使用成本持续下降。
- Flash级模型成为竞争焦点:各家都在发力中低端市场,Flash/Turbo级别的高性价比模型成为用户量最大的产品线,也是竞争最激烈的领域。
- 开源与商业并行:Kimi K3、GLM-5.3-Flash等模型纷纷开源权重,通过开源扩大生态影响力,同时通过API和企业服务实现商业变现。
- 订阅制多样化:从Coding Plan到Token Plan,从个人版到团队版,各厂商正在探索多样化的订阅模式,以满足不同用户群体的需求。
展望
- 价格仍有下降空间:随着技术进步和规模效应,大模型推理成本有望继续下降,用户端价格可能进一步下探。
- 差异化竞争将凸显:当价格和基础能力趋同时,各厂商将在垂直领域优化、工具链整合、生态建设等方面寻求差异化优势。
- 企业服务成为重点:随着个人用户市场竞争加剧,企业级服务(私有化部署、定制化开发、安全合规等)将成为新的增长引擎。
- 监管框架逐步完善:随着大模型应用的普及,数据安全、内容合规、算法透明度等方面的监管要求将逐步细化,合规能力将成为厂商的核心竞争力之一。
数据来源
- 智谱AI官方公告及GLM-5.3-Flash产品页面
- 月之暗面Kimi官方文档及API定价页面
- 阿里云通义千问官方帮助文档及定价页面
- 腾讯云TokenHub MiniMax-M3价格调整公告
- 36氪、界面新闻、IT之家等科技媒体报道
- CSDN、掘金等技术社区分析文章
- 各厂商官方天猫店铺及订阅套餐页面
注:本文信息截至2026年9月8日,价格和功能可能随时调整,具体以各厂商官方发布为准。限时优惠活动请关注官方公告,避免错过使用时机。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论