国内大模型动态日报 | 通义千问0902快照登顶编程榜首,天猫上线Token充值中心

国内大模型动态日报 | 通义千问0902快照登顶编程榜首,天猫上线Token充值中心

Author: zhiqiu16 | Create: 2026-09-05 15:06:59 | Update: 2026-09-05 15:06:59 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

本周国内大模型行业同样热闹非凡。阿里千问在9月2日推送Qwen3.8-Max-0902快照版本,前端编程能力一夜登顶全球第一;天猫在9月3日正式上线"AI空间站"Token充值中心,阿里云、智谱、Kimi、MiniMax等头部厂商集体入驻,AI算力消费首次像话费一样摆上货架。与此同时,国内主流大模型的API定价格局趋于稳定,各家在缓存命中折扣和编程订阅套餐上持续优化。本期将全面梳理Kimi、Qwen、GLM、MiniMax等厂商的最新动态与价格变化。


一、阿里Qwen3.8-Max-0902快照发布:前端编程全球登顶

发布方:阿里通义千问 | 时间:2026年9月2日

核心亮点

  • 0902日期快照版本:Qwen3.8-Max-0902(别名qwen3.8-max-2026-09-02)是qwen3.8-max的快照版本,底座参数未变(总参2.4T、激活95B,稀疏MoE + 混合注意力,1M上下文,原生多模态),但通过后训练实现能力跃升。
  • 前端编程全球第一:在编程能力评测中超越Claude Opus 5,登顶全球榜首。
  • 编码深度再突破:可驾驭更复杂的工程级项目与长程自主开发。
  • 协作智能体能力增强:在多工具调度与端到端交付场景显著提升。
  • 价格未涨:底座没动、参数没堆、价格没涨,纯靠后训练提升能力。

API定价

项目 价格(元/百万Token)
未缓存输入 ¥12
缓存输入 ¥1.5
输出 ¥36
上下文 1M

影响与意义

千问0902快照证明了一个重要趋势:模型能力的提升不再只靠堆参数,后训练优化同样能带来质变。前端编程登顶全球第一,意味着国产大模型在特定垂直领域已具备与国际旗舰(Claude Opus 5)正面竞争的能力。这对于国内企业级编程场景的国产替代具有标志性意义。


二、天猫上线"AI空间站"Token充值中心:AI算力消费化里程碑

发布方:天猫 / 阿里云 | 时间:2026年9月3日

核心亮点

  • 国内首个平台级Token消费入口:AI算力消耗第一次像话费、流量一样摆上消费货架。
  • 首批入驻厂商:阿里云、智谱、Kimi、MiniMax、DeepSeek等国内头部大模型厂商。
  • 产品形态丰富:Token Plan(按周期订阅)、Coding Plan(编程订阅)、按量付费充值方案,支持卡密或直充两种交付方式。
  • 智谱率先入驻:9月2日,智谱在天猫开出官方旗舰店,开售GLM Token套餐,成为首个在天猫开设旗舰店的大模型厂商。

影响与意义

天猫Token充值中心的上线标志着国内AI计费模式进入消费化阶段。这一举措有三重意义:第一,降低了普通用户接触大模型API的门槛,无需注册开发者账号即可使用;第二,为大模型厂商开辟了新的消费级销售渠道;第三,可能催生"Token钱包"类标准入口之争。国内AI资本与应用创新正向"入口层"迁移,而非正面追赶旗舰模型参数。


三、Kimi K3 API定价与Kimi Code编程订阅

发布方:月之暗面 | 时间:最新

核心亮点

  • K3旗舰模型:参数规模约2.8万亿,支持1M Token超长上下文,官方称为"首个开放的超大模型"。
  • 双模式编程产品:Kimi Code搭载K2.7 Code普速版与High Speed高速版双模式,最高推理速度260 Tokens/s,全面兼容Kimi Code CLI、Claude Code、VS Code等主流Agent工具。
  • 缓存命中率优势:官方称编程场景缓存命中率可超90%,大幅降低长代码库反复读取成本。

API定价

项目 价格(元/百万Token)
缓存命中输入 ¥2
未命中输入 ¥20
输出 ¥100
上下文 最高1M

影响与意义

K3的单看输出价格并不便宜(100元/百万Token),但凭借超90%的编程场景缓存命中率,实际使用成本可大幅下降。Kimi Code的双模式设计(普速+高速)满足了不同场景的速度需求,260 Tokens/s的高速推理在国内大模型中处于领先水平。


四、智谱GLM-5.3:编程攻坚与Agent长程任务

发布方:智谱AI | 时间:最新

核心亮点

  • 编程攻坚定位:GLM-5.3在Agent编程、终端操作、长程任务方面表现突出,被定位为"编程攻坚模型"。
  • Coding Plan订阅:提供Lite、Pro、Max等多个订阅版本,适合大型项目重构、复杂工程生成等场景。
  • 超长上下文:支持1M Token,适合阅读整个代码库的编程场景。
  • GLM-5.1同步更新:9月1日更新,定价略低于GLM-5.3。

API定价对比

模型 条件 输入(元/百万Token) 输出(元/百万Token) 缓存命中(元/百万Token)
GLM-5.3 标准 ¥8 ¥28 ¥2
GLM-5.1 标准 ¥6~8 ¥24~28 ¥1~1.5
GLM-5 (0, 32k] ¥4 ¥18 ¥1
GLM-5 32k+ ¥6 ¥22 ¥1.5

影响与意义

智谱在编程领域持续深耕,GLM-5.3的Agent编程能力在国内模型中独树一帜。Coding Plan从40/200/400元/月调整为49/149/469元/月,虽然价格有调整但用量额度也相应变化。智谱率先入驻天猫开设旗舰店,也体现了其在消费级市场的布局决心。


五、MiniMax M2.5/M2.7:高性价比与自我进化

发布方:MiniMax | 时间:最新

核心亮点

  • M2.7自我进化:MiniMax称M2.7是"第一个深度参与迭代自己的模型",在OpenClaw评测中接近最新Sonnet 4.6。
  • M2.5高性价比:MiniMax-M2.5是目前国内主流大模型中价格最低的选项之一。
  • M2.7已上线腾讯云TokenHub:可通过腾讯云大模型服务平台调用。

API定价

模型 输入(元/百万Token) 输出(元/百万Token) 隐式缓存输入(元/百万Token)
MiniMax-M2.5 ¥2.1 ¥8.4 ¥0.42
MiniMax-M2.7 ¥2.1(积分制) ¥8.4(积分制) ¥0.42(积分制)

影响与意义

MiniMax以2.1元/百万Token的输入价格成为国内大模型中的"性价比之王"。M2.7的"自我进化"概念——模型参与自身迭代训练——如果属实,将是AI训练范式的重大创新。M2.7在VIBE-Pro(端到端项目交付)达到55.6%,Terminal Bench 2(复杂工程理解)达到57.0%,显示了不俗的Agent能力。


国内主流大模型API价格总览

厂商 旗舰模型 输入(元/百万Token) 输出(元/百万Token) 缓存命中(元/百万Token) 上下文 推荐定位
阿里 Qwen3.8-Max ¥12 ¥36 ¥1.5 1M 全能旗舰主力
月之暗面 Kimi K3 ¥20 ¥100 ¥2 最高1M 长文档/研究/编程
智谱 GLM-5.3 ¥8 ¥28 ¥2 1M 编程攻坚/Agent
MiniMax M2.5 ¥2.1 ¥8.4 ¥0.42 - 高性价比

趋势总结与展望

本周国内大模型行业呈现以下核心趋势:

  1. 后训练超越参数堆叠:Qwen3.8-Max-0902在不改底座、不涨价格的情况下,纯靠后训练将前端编程做到全球第一,证明后训练优化已成为能力提升的关键路径。这对中小厂商是好消息——不必一味追赶参数规模。

  2. Token消费化时代到来:天猫Token充值中心的上线是一个标志性事件。AI算力从开发者专属工具变为大众消费品,"像充话费一样买Token"将极大降低AI使用门槛。预计未来会出现更多平台级Token销售入口,"Token钱包"标准之争或将上演。

  3. 价格分化加剧:从MiniMax M2.5的2.1元到Kimi K3的100元(输出价),国内大模型价格跨度近50倍。厂商不再追求统一定价,而是根据模型定位和目标用户精准定价。编程场景的缓存命中率成为实际成本的关键变量。

  4. 编程赛道竞争白热化:Qwen前端编程全球登顶、GLM深耕Agent编程、Kimi Code双模式260 Tokens/s——国内编程大模型赛道已形成差异化竞争格局,各家从不同角度切入。

  5. 边缘与极速推理兴起:Qwen 3.8 27B在Cerebras上实现1500 tokens/s推理速度,国产模型搭上极速推理列车。推理速度正成为继参数、上下文之后的下一个竞争维度。

展望未来,国内大模型行业正走出"对标GPT"的跟随阶段,转向差异化竞争。阿里全能、智谱攻坚编程、Kimi长文档、MiniMax性价比——各有护城河。而天猫Token充值中心的出现,可能比任何一次模型发布都更深远地改变AI的普及速度。


数据来源:本文信息综合自千问AI平台官方发布记录(platform.qianwenai.com)、新浪财经、每日经济新闻、南方都市报、腾讯云TokenHub文档、LLMRates.ai、阿里云百炼文档、CSDN技术博客、钛媒体等多源交叉验证。价格信息以各厂商官方公示为准,实际费用可能因促销活动有所调整。

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.