总览
进入 2026 年 9 月,国内大模型"以价换量"的竞争逻辑仍在延续:旗舰模型能力持续上探,同时 API 价格分层愈发清晰。本周重点观察月之暗面 Kimi、阿里通义千问 Qwen、智谱 GLM 与 MiniMax 四家厂商的最新动态与价格变化,供开发者与企业在选型时参考。
一、Kimi(月之暗面):K3 旗舰落地,订阅与 API 双线推进
Kimi K3 作为月之暗面最新旗舰已正式上线:2.8 万亿参数、支持 1M 超长上下文。在 API 定价上,Kimi K3 输入 20 元 / 输出 100 元每百万 token,缓存命中 2 元;面向开发者的 K2.7 Code HighSpeed 定价为输入 13 元 / 输出 54 元。订阅侧,Kimi 推出 Andante(49 元/月)等分层套餐,并新增 Adagio 免费档(目前因算力限制仍处 Waitlist)。
二、Qwen(阿里通义千问):Qwen 3.8 Max 稳居性价比前列
阿里于 8 月 3 日上线 Qwen 3.8 Max(0803),9 月 7 日排名快照中其 AA Intelligence Index 达 53。在国产模型中,Qwen3.5 Flash 以约 0.03 美元/百万输入 token 的成本位居"最便宜梯队",成为预算敏感型场景的热门选择。
三、GLM(智谱AI):GLM-5 系列分层定价,旗舰 GLM-5.3 max 领跑
智谱已形成从 GLM-5 到 GLM-5.3 max 的完整系列(共 22 款模型)。其中 GLM-5 在 32k 以内输入 4 元 / 输出 18 元每百万 token,32k 以上为 6 元 / 22 元,缓存命中低至 1 元。旗舰 GLM-5.3(max)的智能指数达 48.6,是当前国产旗舰中兼顾能力与价格的代表。
四、MiniMax:M2.5 低价走量,M3 价格腰斩
MiniMax 走"低价 + 全量免费额度"路线。MiniMax-M2.5 在阿里云百炼上输入 2.1 元 / 输出 8.4 元,且新用户各送 100 万 token 免费额度;更早前,MiniMax-M3 已于 6 月 15 日执行 50% 幅度的统一降价。
国产旗舰 API 价格对比(每百万 token,人民币)
| 厂商 | 旗舰模型 | 输入 | 输出 | 缓存命中 | 上下文 |
|---|---|---|---|---|---|
| 月之暗面 | Kimi K3 | 20 | 100 | 2 | 1M |
| 月之暗面 | Kimi K2.7 Code HighSpeed | 13 | 54 | 2.6 | — |
| 智谱 | GLM-5(≤32k) | 4 | 18 | 1 | 32k |
| 智谱 | GLM-5(32k+) | 6 | 22 | 1.5 | 1M |
| MiniMax | MiniMax-M2.5 | 2.1 | 8.4 | — | — |
MiniMax-M3 调价前后对比(元/百万 token,512k+ 区间)
| 项目 | 调价前 | 调价后 | 降幅 |
|---|---|---|---|
| 推理输入 | 8.4 | 4.2 | 50% |
| 推理输出 | 33.6 | 16.8 | 50% |
| 缓存命中 | 1.68 | 0.84 | 50% |
趋势总结与展望
国内大模型呈现三个清晰信号:一是"旗舰高价、Flash 走量"的双层价格结构已成主流;二是长上下文(1M)与多模态能力加速下沉,K3、GLM-5 均把超长上下文作为标配;三是订阅制(Coding/Token Plan)与 API 并行,厂商加速向开发者与个人用户两端覆盖。预计下半年降价主战场将转向缓存命中与 agent 场景的按量计费,性价比竞争仍将持续。
数据来源
- 腾讯云 TokenHub 模型价格:https://cloud.tencent.com/document/product/1823/130055
- LLMRates.ai 价格情报:https://www.llmrates.ai/zh-Hans
- 国内大模型 API 价格对比 2026:https://www.traktoken.com/blog/china-llm-comparison-2026
- 阿里云百炼(MiniMax 定价):https://help.aliyun.com/zh/dashscope/developer-reference/tongyi-qianwen-vl-plus-pricing
- 腾讯云 MiniMax-M3 降价公告:https://cloud.tencent.com/announce/detail/2321

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论