国内大模型最新动态:Kimi K3开源、Qwen 3.8-Max发布、价格战全面升级

国内大模型最新动态:Kimi K3开源、Qwen 3.8-Max发布、价格战全面升级

Author: zhiqiu16 | Create: 2026-09-08 13:45:55 | Update: 2026-09-08 13:45:55 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

国内大模型最新动态:Kimi K3开源、Qwen 3.8-Max发布、价格战全面升级

2026年9月,国内大模型赛道硝烟再起。月之暗面Kimi K3开源权重、阿里通义千问Qwen 3.8-Max以2.4万亿参数刷新国产模型规模纪录、智谱GLM Coding Plan套餐改版、天猫上线"AI空间站"让Token像充话费一样买——国内大模型在模型能力、定价策略和生态建设上全面发力,与国际厂商的差距正在快速缩小。

总览:国内大模型赛道的三大趋势

2026年下半年,国内大模型呈现出三个鲜明趋势:

  1. 开源与商业化并行:Kimi K3开源权重,Qwen 3.8-Max以MIT协议开放,但商业化定价策略各有千秋
  2. 价格战进入深水区:从单纯的降价竞争,转向Token套餐制、缓存计费优化、限时折扣等多维度价格策略
  3. 渠道创新:天猫上线"AI空间站",智谱、Kimi等入驻,Token销售走向大众消费化

以下是对四家核心厂商最新动态的深度解读。


一、Kimi K3(月之暗面):开源权重+1M上下文,Token套餐上天猫

发布方/来源

月之暗面(Moonshot AI),2026年7月16日发布,7月27日开源权重

核心亮点

Kimi K3是月之暗面最新一代多模态大语言模型,核心规格如下:

项目 Kimi K3
模型ID kimi-k3
上下文窗口 1,048,576 Token(1M)
最大输出 25,000 Token
输入价格(国内) 20元/百万Token
输出价格(国内) 100元/百万Token
缓存命中输入 2元/百万Token
国际定价 $3.00/$15.00 每百万Token
权重许可 Kimi K3 License(开源权重,收入分级授权)
权重日期 2026-07-27

渠道创新:Kimi K3已入驻天猫"AI空间站",提供多种Token套餐: - 性价比月卡:165万Token/月,33元 - 性价比Pro月卡:275万Token/月,55元 - 另有日包、季包等多种规格

Kimi已于2026年1月28日全面切换为Token计量模式,按输入输出Token计费,且仅统计未命中缓存的Token。目前处于限时3倍额度活动期(至2月28日),活动结束后额度将缩减至1/3。

影响与意义

Kimi K3选择开源权重是一个重要信号——在国内头部厂商中,率先走向开源路线有助于构建开发者生态。1M上下文窗口使其在长文档分析、代码库理解等场景具备竞争力。天猫渠道的开拓则开创了"Token零售化"的先例,将AI能力以消费级产品形态推向大众市场。

不过,100元/百万Token的国内输出定价在国产模型中偏高,与DeepSeek-V4-Flash(2.02元/百万Token)相比差距明显。Kimi的竞争力更多体现在模型能力而非价格上。


二、Qwen 3.8-Max(阿里通义千问):2.4万亿参数,国产最强旗舰

发布方/来源

阿里巴巴,2026年8月3日发布

核心亮点

Qwen 3.8-Max是千问系列迄今规模最大、能力最强的旗舰模型:

项目 Qwen 3.8-Max
参数量 2.4万亿(MoE架构)
上下文窗口 1,000,000 Token(1M)
最大输出 128,000 Token
输入价格(国内) 12元/百万Token
输出价格(国内) 36元/百万Token
缓存命中输入 1.5元/百万Token
缓存写入 15元/百万Token
Batch File输入 6元/百万Token
Batch File输出 18元/百万Token
开源许可 MIT(权重已开源)

对比上一代旗舰Qwen 3.7-Max,3.8-Max在三大核心能力上全面提升: - 代码工程:全栈工程能力显著增强,可自主编程十数天交付完整项目 - 多模态:首款突破万亿参数的原生多模态旗舰,覆盖文本、图像、视频、文档处理 - 推理:在权威第三方榜单Text Arena中排名前列

此外,通义千问还有更具性价比的选择: - qwen3-max:256K上下文,输入2.5元/输出10元 - qwen3.7-max:1M上下文,限时5折后输入3元/输出9元 - Qwen3.5-Flash:128K以内输入0.2元/输出2元

影响与意义

Qwen 3.8-Max的发布标志着国产大模型正式进入万亿参数时代。2.4万亿参数的MoE架构使阿里在模型规模上与GPT-6 Astra、Claude Fable 5.1等国际旗舰站在同一梯队。MIT开源协议的选择更是降低了开发者和企业使用门槛。

从定价看,Qwen 3.8-Max的12/36元定价介于DeepSeek(1/2元)和智谱GLM-5.2(8/28元)之间,兼顾了性能与价格。而Qwen3.5-Flash的0.2/2元定价则面向轻量级应用场景,形成了完整的产品矩阵。


三、智谱GLM:GLM-5.2旗舰+GLM-4.7-Flash免费,Coding Plan改版

发布方/来源

智谱AI,2026年7月30日Coding Plan套餐改版

核心亮点

智谱AI当前产品线布局:

模型 上下文长度 输入价(元/百万Token) 输出价(元/百万Token) 特点
GLM-5.2 1M 8元 28元 旗舰模型
GLM-5.1 128K 6元(<32K) 24元 中端模型
GLM-4.7-Flash 200K 免费 免费 轻量免费

Coding Plan改版:2026年7月30日,智谱AI对GLM Coding Plan套餐进行全面改版,新版采用以Token消耗为基础的积分制,提升额度计算的透明度和可预期性。套餐方案:

套餐 月费 核心调用额度 补货规则
Pro(主推) 149元 5h/400次、周2000次 每日10:00定时补货,拼模立减5%
Max 469元 5h/1600次、周8000次 每日10:00定时补货

天猫"AI空间站"也上线了基于智谱GLM-5.3模型的Coding Plan,适配ZCode、Claude Code等开发工具: - 个人版Lite:118元/周,10,000积分 - 个人版Pro:538元/周,60,000积分 - 个人版Max:1,078元/周,140,000积分 - 团队版标准席位:598元/席/周,66,000积分/席

影响与意义

智谱AI的策略是"高低搭配"——GLM-5.2旗舰定价8/28元,面向专业和企业市场;GLM-4.7-Flash完全免费,200K上下文足以覆盖大多数轻量级应用,是吸引开发者和中小企业的有力手段。

Coding Plan改版向积分制的转变,反映了国内AI厂商在计费模式上从简单的Token计价向更透明、更可预期的方向演进。天猫渠道的加入,使Token购买像"充话费"一样简单,大幅降低了普通用户接触AI能力的门槛。


四、MiniMax-M2.7:高性价比之选

发布方/来源

MiniMax,2026年最新定价

核心亮点

MiniMax-M2.7是MiniMax当前主力模型,在腾讯云TokenHub平台上的定价:

项目 MiniMax-M2.7
输入价格 2.1元/百万Token
输出价格 8.4元/百万Token
缓存命中 0.42元/百万Token

对比上一代MiniMax-M2.5($0.30/$1.20国际定价),M2.7在国内市场保持了高性价比定位。在SWE-bench等编码基准上,MiniMax系列一直有不错的表现。

影响与意义

MiniMax-M2.7的2.1/8.4元定价在国产旗舰模型中处于中低价位,适合追求性价比的企业级应用。0.42元的缓存命中价格也使得在高频调用场景下成本可进一步降低。


五、价格全景对比:2026年9月国产大模型定价一览

旗舰模型定价对比

厂商 旗舰模型 上下文长度 输入价(元/百万Token) 输出价(元/百万Token) 缓存命中(元/百万Token)
DeepSeek DeepSeek-V4-Flash 1M 1.01 2.02 0.02
DeepSeek DeepSeek-V4-Pro 1M 3.13 6.26
MiniMax MiniMax-M2.7 2.1 8.4 0.42
通义千问 qwen3-max 256K 2.5 10
通义千问 qwen3.7-max(5折) 1M 3 9
通义千问 Qwen3.8-Max 1M 12 36 1.5
智谱GLM GLM-5.1(<32K) 128K 6 24
智谱GLM GLM-5.2 1M 8 28
智谱GLM GLM-4.7-Flash 200K 免费 免费
月之暗面 Kimi K3 1M 20 100 2

关键发现

  • 最便宜:DeepSeek-V4-Flash,输入1.01元/输出2.02元,碾压级性价比
  • 免费可用:智谱GLM-4.7-Flash,200K上下文,输入输出全免费
  • 最贵:Kimi K3,输出100元/百万Token,是DeepSeek-V4-Flash的50倍
  • 综合旗舰:Qwen 3.8-Max在万亿参数级别中定价适中(12/36元),性价比突出
  • 缓存优化:DeepSeek缓存命中仅0.02元,MiniMax为0.42元,智谱GLM-5.2未公布缓存价格

Token套餐消费化趋势

天猫"AI空间站"的上线是国内AI行业渠道创新的标志性事件。智谱、Kimi等厂商入驻后,Token销售呈现消费化趋势:

套餐类型 价格 特点
Kimi K3月卡(性价比) 33元 165万Token/月
Kimi K3月卡(Pro) 55元 275万Token/月
智谱GLM Coding Plan Pro 149元/月 5h/400次、周2000次
智谱GLM Coding Plan Max 469元/月 5h/1600次、周8000次

这种"日包、月包、季包"的形态,类似于通信行业的流量套餐,使AI能力的获取门槛大幅降低。


趋势总结与展望

1. 万亿参数时代来临

Qwen 3.8-Max的2.4万亿参数标志着国产大模型正式进入万亿参数俱乐部。结合Kimi K3的1M上下文、GLM-5.2的1M上下文,国内头部厂商在模型规模和上下文窗口上已与国际一线持平。

2. 价格分层清晰,各取所需

国产大模型已形成清晰的三层价格体系: - 超低价层:DeepSeek-V4-Flash(1/2元),面向成本敏感型应用 - 中价层:MiniMax-M2.7(2.1/8.4元)、Qwen3-max(2.5/10元),面向企业级应用 - 旗舰层:Qwen 3.8-Max(12/36元)、GLM-5.2(8/28元),面向最复杂任务

3. 开源与商业化并行不悖

Kimi K3、Qwen 3.8-Max(MIT)、DeepSeek系列均选择开源路线,但商业化定价各不相同。开源吸引生态,商业化保障可持续性——这一平衡术正在被国内厂商熟练运用。

4. Token消费化降低使用门槛

天猫"AI空间站"将Token以"话费套餐"的形态推向大众市场,是AI能力普及化的重要一步。智谱GLM Coding Plan的积分制改版也体现了计费模式从"技术指标"向"消费体验"的转变。

5. 免费策略成为获客利器

智谱GLM-4.7-Flash的全免费策略在国产厂商中独树一帜。200K上下文免费使用,足以覆盖大量轻量级应用场景,有望成为开发者入门的首选。

展望未来,国内大模型赛道将进入"能力追赶+生态构建+渠道创新"的三维竞争阶段。Qwen 3.8-Max和Kimi K3代表了国产模型在能力上的快速进步,天猫渠道创新则展示了商业模式的灵活探索。在国际厂商密集发布旗舰模型的背景下,国内厂商的快速跟进和差异化定价策略,正使中国成为全球AI竞争中不可或缺的力量。


数据来源

本文信息综合自以下公开来源: - 阿里云百炼帮助中心(help.aliyun.com/zh/model-studio) - 阿里巴巴集团官网(alibabagroup.com) - 腾讯云TokenHub模型价格(cloud.tencent.com) - 智谱AI开放文档(docs.bigmodel.cn) - Kimi官方定价页(kimi.com/resources/kimi-k3-pricing) - CSDN技术社区(blog.csdn.net) - 每日经济新闻( Toutiao.com) - 360智脑开放平台(ai.360.com)

文章信息截至2026年9月8日,如有后续更新请以各厂商官方公告为准。

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.