国内大模型动态与价格盘点:Qwen3.8-Max 上新、Kimi K3 走高价、智谱开淘宝店
进入 2026 年 9 月,国产大模型集体从"拼参数"转入"拼商业化"。新模型密集上新、Flash 级低价模型持续刷新下限、头部厂商开始电商开店卖订阅,价格与商业化成为本周国内大模型行业的主线。本文梳理本周最值得关注的动态与关键价格变化。
一、阿里通义千问:Qwen3.8-Max 上新,Flash 版刷新低价
9 月 2 日,阿里上线 Qwen3.8-Max(模型 ID qwen3.8-max-2026-09-02),定位"全能旗舰主力",在中文、办公、编程与多模态上表现均衡,上下文窗口达 1M tokens。其公开标价为:
- 输入:¥12 / 百万 tokens
- 输入(缓存命中):¥1.5 / 百万 tokens
- 输出:¥36 / 百万 tokens
同日,阿里还发布并开源了 Qwen3.8-Flash,官方称通过新架构与训练方式大幅降低推理成本,标价输入 ¥1、输出 ¥3(每百万 tokens),最低可至 DeepSeek V4 Flash 的约 1/3,成为本周最具性价比的国产模型之一。
二、月之暗面 Kimi:K3 坚持"高价 = 高价值"
月之暗面的 Kimi K3 继续定位于高价值知识工作场景(长文档、深度研究、前端、3D),上下文窗口最高 1M,但其价格在国产头部模型中处于高位:
- 输入:¥20 / 百万 tokens
- 输入(缓存命中):¥2 / 百万 tokens
- 输出:¥100 / 百万 tokens
Kimi K3 的高输出价格反映了其"重推理、长上下文"的技术路线,适合对准确性要求高的研究型任务,而与 Flash 级低价模型形成明确差异化的市场定位。
三、智谱 AI:GLM-5 低价入场,GLM Coding Plan 开淘宝店
智谱本周在商业化上动作最多。其 GLM-5 采用按输入长度分段定价,处于国产旗舰中的低档区间:
- 输入 0–32k:¥4,32k 以上:¥6(每百万 tokens)
- 输出:¥18(0–32k)/ ¥22(32k 以上)
- 缓存命中:¥1 / ¥1.5
更早前上线的 GLM-5.3-Flash 已开源,定价为上一版本 GLM-5.3 的约 1/10(限时折扣内为 1/20),进一步拉低推理成本下限。
与此同时,9 月 2 日智谱在天猫开出官方旗舰店,将 GLM Coding Plan 拆分为个人版 Lite / Pro / Max 与团队版标准席位等多个档位在线销售,支持按月、季、年订阅。这标志着国产大模型从纯 API 计费,正式走向面向个人开发者与团队的订阅制零售。
四、MiniMax:M2.5 / M3 稳步推进
MiniMax 的 M2.5 在部分榜单中位居国产模型前列,M3 亦已进入市场。作为以语音、多模态见长的厂商,MiniMax 本周延续了"全栈模型 + 应用"路线,虽无重大价格变动,但其在消费级与开发者市场的双线布局仍值得持续关注。
价格对比一览
| 模型 | 输入(元/百万 tokens) | 缓存输入 | 输出(元/百万 tokens) | 上下文 |
|---|---|---|---|---|
| Qwen3.8-Max | 12 | 1.5 | 36 | 1M |
| Qwen3.8-Flash | 1 | - | 3 | 开源 |
| Kimi K3 | 20 | 2.0 | 100 | 最高 1M |
| GLM-5(0–32k) | 4 | 1.0 | 18 | - |
| GLM-5(32k+) | 6 | 1.5 | 22 | - |
注:以上为各厂商/云平台公开标价,实际账单可能因缓存命中率、峰谷计费与活动折扣而产生差异。
趋势总结与展望
- 价格分层清晰化:国产模型已形成"¥1 级 Flash → ¥4–12 级旗舰 → ¥20 级高价值模型"的完整价格梯度,用户按需选择的空间更大。
- Flash 级低价化:Qwen3.8-Flash、GLM-5.3-Flash 等低价开源模型持续挤压 DeepSeek 的"性价比"标签,价格战向更深区间蔓延。
- 商业化多元化:智谱开淘宝店卖订阅、DeepSeek 推行峰谷定价,说明行业正从"拼 API 单价"转向"订阅、零售、动态计费"并行的多元变现。
数据来源:阿里云百炼(Model Studio)定价页、千问 AI 平台、月之暗面开放平台、智谱开放平台、腾讯云 TokenHub 及 36 氪、蓝鲸新闻等媒体报道,价格与发布时间以各厂商官方页面为准。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论