国内大模型最新动态:Kimi K3开源、Qwen 3.8-Max发布、价格战全面升级
2026年9月,国内大模型赛道硝烟再起。月之暗面Kimi K3开源权重、阿里通义千问Qwen 3.8-Max以2.4万亿参数刷新国产模型规模纪录、智谱GLM Coding Plan套餐改版、天猫上线"AI空间站"让Token像充话费一样买——国内大模型在模型能力、定价策略和生态建设上全面发力,与国际厂商的差距正在快速缩小。
总览:国内大模型赛道的三大趋势
2026年下半年,国内大模型呈现出三个鲜明趋势:
- 开源与商业化并行:Kimi K3开源权重,Qwen 3.8-Max以MIT协议开放,但商业化定价策略各有千秋
- 价格战进入深水区:从单纯的降价竞争,转向Token套餐制、缓存计费优化、限时折扣等多维度价格策略
- 渠道创新:天猫上线"AI空间站",智谱、Kimi等入驻,Token销售走向大众消费化
以下是对四家核心厂商最新动态的深度解读。
一、Kimi K3(月之暗面):开源权重+1M上下文,Token套餐上天猫
发布方/来源
月之暗面(Moonshot AI),2026年7月16日发布,7月27日开源权重
核心亮点
Kimi K3是月之暗面最新一代多模态大语言模型,核心规格如下:
| 项目 | Kimi K3 |
|---|---|
| 模型ID | kimi-k3 |
| 上下文窗口 | 1,048,576 Token(1M) |
| 最大输出 | 25,000 Token |
| 输入价格(国内) | 20元/百万Token |
| 输出价格(国内) | 100元/百万Token |
| 缓存命中输入 | 2元/百万Token |
| 国际定价 | $3.00/$15.00 每百万Token |
| 权重许可 | Kimi K3 License(开源权重,收入分级授权) |
| 权重日期 | 2026-07-27 |
渠道创新:Kimi K3已入驻天猫"AI空间站",提供多种Token套餐: - 性价比月卡:165万Token/月,33元 - 性价比Pro月卡:275万Token/月,55元 - 另有日包、季包等多种规格
Kimi已于2026年1月28日全面切换为Token计量模式,按输入输出Token计费,且仅统计未命中缓存的Token。目前处于限时3倍额度活动期(至2月28日),活动结束后额度将缩减至1/3。
影响与意义
Kimi K3选择开源权重是一个重要信号——在国内头部厂商中,率先走向开源路线有助于构建开发者生态。1M上下文窗口使其在长文档分析、代码库理解等场景具备竞争力。天猫渠道的开拓则开创了"Token零售化"的先例,将AI能力以消费级产品形态推向大众市场。
不过,100元/百万Token的国内输出定价在国产模型中偏高,与DeepSeek-V4-Flash(2.02元/百万Token)相比差距明显。Kimi的竞争力更多体现在模型能力而非价格上。
二、Qwen 3.8-Max(阿里通义千问):2.4万亿参数,国产最强旗舰
发布方/来源
阿里巴巴,2026年8月3日发布
核心亮点
Qwen 3.8-Max是千问系列迄今规模最大、能力最强的旗舰模型:
| 项目 | Qwen 3.8-Max |
|---|---|
| 参数量 | 2.4万亿(MoE架构) |
| 上下文窗口 | 1,000,000 Token(1M) |
| 最大输出 | 128,000 Token |
| 输入价格(国内) | 12元/百万Token |
| 输出价格(国内) | 36元/百万Token |
| 缓存命中输入 | 1.5元/百万Token |
| 缓存写入 | 15元/百万Token |
| Batch File输入 | 6元/百万Token |
| Batch File输出 | 18元/百万Token |
| 开源许可 | MIT(权重已开源) |
对比上一代旗舰Qwen 3.7-Max,3.8-Max在三大核心能力上全面提升: - 代码工程:全栈工程能力显著增强,可自主编程十数天交付完整项目 - 多模态:首款突破万亿参数的原生多模态旗舰,覆盖文本、图像、视频、文档处理 - 推理:在权威第三方榜单Text Arena中排名前列
此外,通义千问还有更具性价比的选择: - qwen3-max:256K上下文,输入2.5元/输出10元 - qwen3.7-max:1M上下文,限时5折后输入3元/输出9元 - Qwen3.5-Flash:128K以内输入0.2元/输出2元
影响与意义
Qwen 3.8-Max的发布标志着国产大模型正式进入万亿参数时代。2.4万亿参数的MoE架构使阿里在模型规模上与GPT-6 Astra、Claude Fable 5.1等国际旗舰站在同一梯队。MIT开源协议的选择更是降低了开发者和企业使用门槛。
从定价看,Qwen 3.8-Max的12/36元定价介于DeepSeek(1/2元)和智谱GLM-5.2(8/28元)之间,兼顾了性能与价格。而Qwen3.5-Flash的0.2/2元定价则面向轻量级应用场景,形成了完整的产品矩阵。
三、智谱GLM:GLM-5.2旗舰+GLM-4.7-Flash免费,Coding Plan改版
发布方/来源
智谱AI,2026年7月30日Coding Plan套餐改版
核心亮点
智谱AI当前产品线布局:
| 模型 | 上下文长度 | 输入价(元/百万Token) | 输出价(元/百万Token) | 特点 |
|---|---|---|---|---|
| GLM-5.2 | 1M | 8元 | 28元 | 旗舰模型 |
| GLM-5.1 | 128K | 6元(<32K) | 24元 | 中端模型 |
| GLM-4.7-Flash | 200K | 免费 | 免费 | 轻量免费 |
Coding Plan改版:2026年7月30日,智谱AI对GLM Coding Plan套餐进行全面改版,新版采用以Token消耗为基础的积分制,提升额度计算的透明度和可预期性。套餐方案:
| 套餐 | 月费 | 核心调用额度 | 补货规则 |
|---|---|---|---|
| Pro(主推) | 149元 | 5h/400次、周2000次 | 每日10:00定时补货,拼模立减5% |
| Max | 469元 | 5h/1600次、周8000次 | 每日10:00定时补货 |
天猫"AI空间站"也上线了基于智谱GLM-5.3模型的Coding Plan,适配ZCode、Claude Code等开发工具: - 个人版Lite:118元/周,10,000积分 - 个人版Pro:538元/周,60,000积分 - 个人版Max:1,078元/周,140,000积分 - 团队版标准席位:598元/席/周,66,000积分/席
影响与意义
智谱AI的策略是"高低搭配"——GLM-5.2旗舰定价8/28元,面向专业和企业市场;GLM-4.7-Flash完全免费,200K上下文足以覆盖大多数轻量级应用,是吸引开发者和中小企业的有力手段。
Coding Plan改版向积分制的转变,反映了国内AI厂商在计费模式上从简单的Token计价向更透明、更可预期的方向演进。天猫渠道的加入,使Token购买像"充话费"一样简单,大幅降低了普通用户接触AI能力的门槛。
四、MiniMax-M2.7:高性价比之选
发布方/来源
MiniMax,2026年最新定价
核心亮点
MiniMax-M2.7是MiniMax当前主力模型,在腾讯云TokenHub平台上的定价:
| 项目 | MiniMax-M2.7 |
|---|---|
| 输入价格 | 2.1元/百万Token |
| 输出价格 | 8.4元/百万Token |
| 缓存命中 | 0.42元/百万Token |
对比上一代MiniMax-M2.5($0.30/$1.20国际定价),M2.7在国内市场保持了高性价比定位。在SWE-bench等编码基准上,MiniMax系列一直有不错的表现。
影响与意义
MiniMax-M2.7的2.1/8.4元定价在国产旗舰模型中处于中低价位,适合追求性价比的企业级应用。0.42元的缓存命中价格也使得在高频调用场景下成本可进一步降低。
五、价格全景对比:2026年9月国产大模型定价一览
旗舰模型定价对比
| 厂商 | 旗舰模型 | 上下文长度 | 输入价(元/百万Token) | 输出价(元/百万Token) | 缓存命中(元/百万Token) |
|---|---|---|---|---|---|
| DeepSeek | DeepSeek-V4-Flash | 1M | 1.01 | 2.02 | 0.02 |
| DeepSeek | DeepSeek-V4-Pro | 1M | 3.13 | 6.26 | — |
| MiniMax | MiniMax-M2.7 | — | 2.1 | 8.4 | 0.42 |
| 通义千问 | qwen3-max | 256K | 2.5 | 10 | — |
| 通义千问 | qwen3.7-max(5折) | 1M | 3 | 9 | — |
| 通义千问 | Qwen3.8-Max | 1M | 12 | 36 | 1.5 |
| 智谱GLM | GLM-5.1(<32K) | 128K | 6 | 24 | — |
| 智谱GLM | GLM-5.2 | 1M | 8 | 28 | — |
| 智谱GLM | GLM-4.7-Flash | 200K | 免费 | 免费 | — |
| 月之暗面 | Kimi K3 | 1M | 20 | 100 | 2 |
关键发现
- 最便宜:DeepSeek-V4-Flash,输入1.01元/输出2.02元,碾压级性价比
- 免费可用:智谱GLM-4.7-Flash,200K上下文,输入输出全免费
- 最贵:Kimi K3,输出100元/百万Token,是DeepSeek-V4-Flash的50倍
- 综合旗舰:Qwen 3.8-Max在万亿参数级别中定价适中(12/36元),性价比突出
- 缓存优化:DeepSeek缓存命中仅0.02元,MiniMax为0.42元,智谱GLM-5.2未公布缓存价格
Token套餐消费化趋势
天猫"AI空间站"的上线是国内AI行业渠道创新的标志性事件。智谱、Kimi等厂商入驻后,Token销售呈现消费化趋势:
| 套餐类型 | 价格 | 特点 |
|---|---|---|
| Kimi K3月卡(性价比) | 33元 | 165万Token/月 |
| Kimi K3月卡(Pro) | 55元 | 275万Token/月 |
| 智谱GLM Coding Plan Pro | 149元/月 | 5h/400次、周2000次 |
| 智谱GLM Coding Plan Max | 469元/月 | 5h/1600次、周8000次 |
这种"日包、月包、季包"的形态,类似于通信行业的流量套餐,使AI能力的获取门槛大幅降低。
趋势总结与展望
1. 万亿参数时代来临
Qwen 3.8-Max的2.4万亿参数标志着国产大模型正式进入万亿参数俱乐部。结合Kimi K3的1M上下文、GLM-5.2的1M上下文,国内头部厂商在模型规模和上下文窗口上已与国际一线持平。
2. 价格分层清晰,各取所需
国产大模型已形成清晰的三层价格体系: - 超低价层:DeepSeek-V4-Flash(1/2元),面向成本敏感型应用 - 中价层:MiniMax-M2.7(2.1/8.4元)、Qwen3-max(2.5/10元),面向企业级应用 - 旗舰层:Qwen 3.8-Max(12/36元)、GLM-5.2(8/28元),面向最复杂任务
3. 开源与商业化并行不悖
Kimi K3、Qwen 3.8-Max(MIT)、DeepSeek系列均选择开源路线,但商业化定价各不相同。开源吸引生态,商业化保障可持续性——这一平衡术正在被国内厂商熟练运用。
4. Token消费化降低使用门槛
天猫"AI空间站"将Token以"话费套餐"的形态推向大众市场,是AI能力普及化的重要一步。智谱GLM Coding Plan的积分制改版也体现了计费模式从"技术指标"向"消费体验"的转变。
5. 免费策略成为获客利器
智谱GLM-4.7-Flash的全免费策略在国产厂商中独树一帜。200K上下文免费使用,足以覆盖大量轻量级应用场景,有望成为开发者入门的首选。
展望未来,国内大模型赛道将进入"能力追赶+生态构建+渠道创新"的三维竞争阶段。Qwen 3.8-Max和Kimi K3代表了国产模型在能力上的快速进步,天猫渠道创新则展示了商业模式的灵活探索。在国际厂商密集发布旗舰模型的背景下,国内厂商的快速跟进和差异化定价策略,正使中国成为全球AI竞争中不可或缺的力量。
数据来源
本文信息综合自以下公开来源: - 阿里云百炼帮助中心(help.aliyun.com/zh/model-studio) - 阿里巴巴集团官网(alibabagroup.com) - 腾讯云TokenHub模型价格(cloud.tencent.com) - 智谱AI开放文档(docs.bigmodel.cn) - Kimi官方定价页(kimi.com/resources/kimi-k3-pricing) - CSDN技术社区(blog.csdn.net) - 每日经济新闻( Toutiao.com) - 360智脑开放平台(ai.360.com)
文章信息截至2026年9月8日,如有后续更新请以各厂商官方公告为准。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论