本周国内大模型行业同样热闹非凡。阿里千问在9月2日推送Qwen3.8-Max-0902快照版本,前端编程能力一夜登顶全球第一;天猫在9月3日正式上线"AI空间站"Token充值中心,阿里云、智谱、Kimi、MiniMax等头部厂商集体入驻,AI算力消费首次像话费一样摆上货架。与此同时,国内主流大模型的API定价格局趋于稳定,各家在缓存命中折扣和编程订阅套餐上持续优化。本期将全面梳理Kimi、Qwen、GLM、MiniMax等厂商的最新动态与价格变化。
一、阿里Qwen3.8-Max-0902快照发布:前端编程全球登顶
发布方:阿里通义千问 | 时间:2026年9月2日
核心亮点
- 0902日期快照版本:Qwen3.8-Max-0902(别名qwen3.8-max-2026-09-02)是qwen3.8-max的快照版本,底座参数未变(总参2.4T、激活95B,稀疏MoE + 混合注意力,1M上下文,原生多模态),但通过后训练实现能力跃升。
- 前端编程全球第一:在编程能力评测中超越Claude Opus 5,登顶全球榜首。
- 编码深度再突破:可驾驭更复杂的工程级项目与长程自主开发。
- 协作智能体能力增强:在多工具调度与端到端交付场景显著提升。
- 价格未涨:底座没动、参数没堆、价格没涨,纯靠后训练提升能力。
API定价
| 项目 | 价格(元/百万Token) |
|---|---|
| 未缓存输入 | ¥12 |
| 缓存输入 | ¥1.5 |
| 输出 | ¥36 |
| 上下文 | 1M |
影响与意义
千问0902快照证明了一个重要趋势:模型能力的提升不再只靠堆参数,后训练优化同样能带来质变。前端编程登顶全球第一,意味着国产大模型在特定垂直领域已具备与国际旗舰(Claude Opus 5)正面竞争的能力。这对于国内企业级编程场景的国产替代具有标志性意义。
二、天猫上线"AI空间站"Token充值中心:AI算力消费化里程碑
发布方:天猫 / 阿里云 | 时间:2026年9月3日
核心亮点
- 国内首个平台级Token消费入口:AI算力消耗第一次像话费、流量一样摆上消费货架。
- 首批入驻厂商:阿里云、智谱、Kimi、MiniMax、DeepSeek等国内头部大模型厂商。
- 产品形态丰富:Token Plan(按周期订阅)、Coding Plan(编程订阅)、按量付费充值方案,支持卡密或直充两种交付方式。
- 智谱率先入驻:9月2日,智谱在天猫开出官方旗舰店,开售GLM Token套餐,成为首个在天猫开设旗舰店的大模型厂商。
影响与意义
天猫Token充值中心的上线标志着国内AI计费模式进入消费化阶段。这一举措有三重意义:第一,降低了普通用户接触大模型API的门槛,无需注册开发者账号即可使用;第二,为大模型厂商开辟了新的消费级销售渠道;第三,可能催生"Token钱包"类标准入口之争。国内AI资本与应用创新正向"入口层"迁移,而非正面追赶旗舰模型参数。
三、Kimi K3 API定价与Kimi Code编程订阅
发布方:月之暗面 | 时间:最新
核心亮点
- K3旗舰模型:参数规模约2.8万亿,支持1M Token超长上下文,官方称为"首个开放的超大模型"。
- 双模式编程产品:Kimi Code搭载K2.7 Code普速版与High Speed高速版双模式,最高推理速度260 Tokens/s,全面兼容Kimi Code CLI、Claude Code、VS Code等主流Agent工具。
- 缓存命中率优势:官方称编程场景缓存命中率可超90%,大幅降低长代码库反复读取成本。
API定价
| 项目 | 价格(元/百万Token) |
|---|---|
| 缓存命中输入 | ¥2 |
| 未命中输入 | ¥20 |
| 输出 | ¥100 |
| 上下文 | 最高1M |
影响与意义
K3的单看输出价格并不便宜(100元/百万Token),但凭借超90%的编程场景缓存命中率,实际使用成本可大幅下降。Kimi Code的双模式设计(普速+高速)满足了不同场景的速度需求,260 Tokens/s的高速推理在国内大模型中处于领先水平。
四、智谱GLM-5.3:编程攻坚与Agent长程任务
发布方:智谱AI | 时间:最新
核心亮点
- 编程攻坚定位:GLM-5.3在Agent编程、终端操作、长程任务方面表现突出,被定位为"编程攻坚模型"。
- Coding Plan订阅:提供Lite、Pro、Max等多个订阅版本,适合大型项目重构、复杂工程生成等场景。
- 超长上下文:支持1M Token,适合阅读整个代码库的编程场景。
- GLM-5.1同步更新:9月1日更新,定价略低于GLM-5.3。
API定价对比
| 模型 | 条件 | 输入(元/百万Token) | 输出(元/百万Token) | 缓存命中(元/百万Token) |
|---|---|---|---|---|
| GLM-5.3 | 标准 | ¥8 | ¥28 | ¥2 |
| GLM-5.1 | 标准 | ¥6~8 | ¥24~28 | ¥1~1.5 |
| GLM-5 | (0, 32k] | ¥4 | ¥18 | ¥1 |
| GLM-5 | 32k+ | ¥6 | ¥22 | ¥1.5 |
影响与意义
智谱在编程领域持续深耕,GLM-5.3的Agent编程能力在国内模型中独树一帜。Coding Plan从40/200/400元/月调整为49/149/469元/月,虽然价格有调整但用量额度也相应变化。智谱率先入驻天猫开设旗舰店,也体现了其在消费级市场的布局决心。
五、MiniMax M2.5/M2.7:高性价比与自我进化
发布方:MiniMax | 时间:最新
核心亮点
- M2.7自我进化:MiniMax称M2.7是"第一个深度参与迭代自己的模型",在OpenClaw评测中接近最新Sonnet 4.6。
- M2.5高性价比:MiniMax-M2.5是目前国内主流大模型中价格最低的选项之一。
- M2.7已上线腾讯云TokenHub:可通过腾讯云大模型服务平台调用。
API定价
| 模型 | 输入(元/百万Token) | 输出(元/百万Token) | 隐式缓存输入(元/百万Token) |
|---|---|---|---|
| MiniMax-M2.5 | ¥2.1 | ¥8.4 | ¥0.42 |
| MiniMax-M2.7 | ¥2.1(积分制) | ¥8.4(积分制) | ¥0.42(积分制) |
影响与意义
MiniMax以2.1元/百万Token的输入价格成为国内大模型中的"性价比之王"。M2.7的"自我进化"概念——模型参与自身迭代训练——如果属实,将是AI训练范式的重大创新。M2.7在VIBE-Pro(端到端项目交付)达到55.6%,Terminal Bench 2(复杂工程理解)达到57.0%,显示了不俗的Agent能力。
国内主流大模型API价格总览
| 厂商 | 旗舰模型 | 输入(元/百万Token) | 输出(元/百万Token) | 缓存命中(元/百万Token) | 上下文 | 推荐定位 |
|---|---|---|---|---|---|---|
| 阿里 | Qwen3.8-Max | ¥12 | ¥36 | ¥1.5 | 1M | 全能旗舰主力 |
| 月之暗面 | Kimi K3 | ¥20 | ¥100 | ¥2 | 最高1M | 长文档/研究/编程 |
| 智谱 | GLM-5.3 | ¥8 | ¥28 | ¥2 | 1M | 编程攻坚/Agent |
| MiniMax | M2.5 | ¥2.1 | ¥8.4 | ¥0.42 | - | 高性价比 |
趋势总结与展望
本周国内大模型行业呈现以下核心趋势:
-
后训练超越参数堆叠:Qwen3.8-Max-0902在不改底座、不涨价格的情况下,纯靠后训练将前端编程做到全球第一,证明后训练优化已成为能力提升的关键路径。这对中小厂商是好消息——不必一味追赶参数规模。
-
Token消费化时代到来:天猫Token充值中心的上线是一个标志性事件。AI算力从开发者专属工具变为大众消费品,"像充话费一样买Token"将极大降低AI使用门槛。预计未来会出现更多平台级Token销售入口,"Token钱包"标准之争或将上演。
-
价格分化加剧:从MiniMax M2.5的2.1元到Kimi K3的100元(输出价),国内大模型价格跨度近50倍。厂商不再追求统一定价,而是根据模型定位和目标用户精准定价。编程场景的缓存命中率成为实际成本的关键变量。
-
编程赛道竞争白热化:Qwen前端编程全球登顶、GLM深耕Agent编程、Kimi Code双模式260 Tokens/s——国内编程大模型赛道已形成差异化竞争格局,各家从不同角度切入。
-
边缘与极速推理兴起:Qwen 3.8 27B在Cerebras上实现1500 tokens/s推理速度,国产模型搭上极速推理列车。推理速度正成为继参数、上下文之后的下一个竞争维度。
展望未来,国内大模型行业正走出"对标GPT"的跟随阶段,转向差异化竞争。阿里全能、智谱攻坚编程、Kimi长文档、MiniMax性价比——各有护城河。而天猫Token充值中心的出现,可能比任何一次模型发布都更深远地改变AI的普及速度。
数据来源:本文信息综合自千问AI平台官方发布记录(platform.qianwenai.com)、新浪财经、每日经济新闻、南方都市报、腾讯云TokenHub文档、LLMRates.ai、阿里云百炼文档、CSDN技术博客、钛媒体等多源交叉验证。价格信息以各厂商官方公示为准,实际费用可能因促销活动有所调整。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论