2026年8月24日 · 本期聚焦国内大模型价格调整与行业动态
本期总览
2026 年的国内大模型市场,正在经历一场深刻的价格范式转换——从"降价抢市场"转向"价值定价"。
8 月以来,DeepSeek 推出峰谷定价机制并在 8 月 23 日进一步优化规则,成为行业焦点事件;智谱 AI 年内完成三次调价,Kimi K3 发布时价格较前代涨超 3 倍,MiniMax M3 发布时 API 价格全面翻倍。"大模型六小虎"中已有四家完成涨价。
但值得注意的是,拥有自有算力的大厂——阿里、腾讯、字节——却按兵不动或仅变相调价。这种分化背后,是商业模式和竞争策略的根本差异。
本期我们整理了 5 条最重要的国内大模型动态,并附上详细的价格对比分析。
1. DeepSeek:峰谷定价再优化,周末全按低谷计费
发布方:深度求索(DeepSeek)
核心亮点:8 月 23 日起优化峰谷计费规则,周六、周日全天统一按低谷时段价格计费,降低用户周末使用成本。
事件详情
DeepSeek API 开放平台自 2026 年 8 月 17 日起正式实施峰谷定价机制,并于 8 月 23 日进一步优化规则:
高峰时段:北京时间 9:00-12:00、14:00-18:00(工作日)
低谷时段:其余所有时间(含工作日夜间、周末全天)
DeepSeek V4 Pro 价格表:
| 时段 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
|---|---|---|---|
| 高峰时段 | ¥0.30 / 百万 tokens | ¥9.0 / 百万 tokens | ¥27.0 / 百万 tokens |
| 低谷时段 | ¥0.15 / 百万 tokens | ¥4.5 / 百万 tokens | ¥13.5 / 百万 tokens |
DeepSeek V4 Flash 价格表:
| 时段 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
|---|---|---|---|
| 高峰时段 | ¥0.10 / 百万 tokens | ¥3.0 / 百万 tokens | ¥9.0 / 百万 tokens |
| 低谷时段 | ¥0.05 / 百万 tokens | ¥1.5 / 百万 tokens | ¥4.5 / 百万 tokens |
8 月 23 日的优化主要是:周六、周日全天不再区分峰谷,统一按低谷价格计费,给用户更多实惠。
影响与意义
DeepSeek 的峰谷定价是国内大模型行业的一次定价机制创新。它借鉴了电力行业的峰谷电价思路,通过价格杠杆引导用户错峰使用,从而优化算力资源的利用效率。
对于用户而言,峰谷定价带来了更大的成本优化空间: - 非实时性任务(如批量处理、离线分析)可以安排在低谷时段,成本直接减半 - 缓存命中价格极低(V4 Pro 低谷仅 ¥0.15/百万),对于有大量重复上下文的场景非常友好 - 周末全低谷的政策,适合集中处理大量任务
但另一方面,高峰时段 V4 Pro 输出 ¥27/百万 tokens 的价格,相较之前的 ¥6 涨幅达 4.5 倍,对实时性要求高的用户来说成本压力显著增加。这也倒逼开发者重新评估自己的工作流,进行更精细的成本管理。
2. 月之暗面:Kimi K3 发布,价格涨超 3 倍
发布方:月之暗面(Moonshot AI)
核心亮点:Kimi K3 发布时大幅上调定价,输入 ¥20/百万 tokens、输出 ¥100/百万 tokens,较前代涨超 3 倍。
事件详情
7 月,月之暗面发布 Kimi K3 旗舰模型,同时公布了新的 API 定价:
| 模型 | 输入价格 | 输出价格 | 缓存命中 |
|---|---|---|---|
| Kimi K3 | ¥20 / 百万 tokens | ¥100 / 百万 tokens | ¥2 / 百万 tokens |
| Kimi K2.7 | ¥3.2 / 百万 tokens | ¥16 / 百万 tokens | ¥0.32 / 百万 tokens |
| Kimi K2.6 | ¥0.8 / 百万 tokens | ¥4 / 百万 tokens | ¥0.08 / 百万 tokens |
价格涨幅之高,在国内大模型行业实属罕见。Kimi K3 的输出价格(¥100/百万 tokens)甚至超过了部分国际一线模型的价格水平。
影响与意义
Kimi K3 的大幅提价,释放出一个明确信号:国内大模型正在告别"低价内卷"时代。月之暗面敢于将旗舰模型价格提升 3 倍以上,说明其对 K3 的能力有足够信心,也说明市场上确实存在愿意为高质量模型付费的客户群体。
从另一个角度看,这也意味着国内大模型市场正在形成分层格局: - 旗舰层:Kimi K3、GLM-5.3 Max 等,价格高、性能强,面向高价值场景 - 主力层:Kimi K2.7、GLM-5、Qwen3.8 等,性价比均衡,面向通用场景 - 性价比层:Kimi K2.6、DeepSeek V4 Flash 等,价格极低,面向大规模调用
对于开发者和企业来说,选择模型不再是"越便宜越好",而是需要根据具体场景的性能需求和成本预算进行精细化选型。
3. 智谱 AI:年内三次调价,GLM 系列价格持续上行
发布方:智谱 AI(Zhipu AI)
核心亮点:2026 年内已完成三轮价格上调,是本轮涨价潮中调价次数最多的头部厂商。
事件详情
智谱 AI 在 2026 年的涨价节奏最为密集,年内已完成三轮调价:
| 时间 | 事件 | 调价幅度 |
|---|---|---|
| 2026年2月 | GLM Coding Plan 结构性上调 | 结构性调整 |
| 2026年3月 | GLM-5-Turbo API 调价 | +20% |
| 2026年4月 | GLM-5.1 发布时调价 | +10% |
当前 GLM-5 系列的 API 价格(腾讯云 TokenHub 数据):
| 模型 | 条件 | 推理输入 | 推理输出 | 缓存命中 |
|---|---|---|---|---|
| GLM-5 | 输入长度 (0, 32k] | ¥4 / 百万 tokens | ¥18 / 百万 tokens | ¥1 / 百万 tokens |
| GLM-5 | 输入长度 32k+ | ¥6 / 百万 tokens | ¥22 / 百万 tokens | ¥1.5 / 百万 tokens |
| GLM-5.3 | - | ¥8 / 百万 tokens | ¥28 / 百万 tokens | - |
据国金证券研报数据,智谱 AI 的 ARR(年度经常性收入)在五个月内从 1 亿美元增长到 10 亿美元,增速惊人。
影响与意义
智谱 AI 的三次涨价,以及 ARR 的快速增长,证明了一件事:优质大模型的付费意愿真实存在,且在快速提升。客户愿意为更好的模型能力、更稳定的服务质量支付更高的价格。
这也反映出智谱 AI 的商业化策略:通过持续的模型迭代和服务升级,支撑价格的稳步提升。每一次模型更新都伴随着一定幅度的涨价,形成"能力提升 → 价格提升 → 收入增长 → 研发投入加大 → 能力再提升"的正向循环。
对于行业而言,智谱的成功路径给其他独立大模型厂商提供了参考:只要产品力足够强,涨价不仅不会导致客户流失,反而可能因为筛选出高价值客户而提升整体营收质量。
4. MiniMax:M3 发布时 API 价格全面翻倍
发布方:MiniMax(稀宇科技)
核心亮点:6 月发布第三代旗舰模型 M3 时,将 API 价格全面上调一倍。
事件详情
2026 年 6 月 1 日,MiniMax 发布第三代旗舰模型 M3,同时宣布 API 价格全面翻倍。这是继智谱、月之暗面之后,又一家选择在新模型发布时大幅提价的独立厂商。
至此,"大模型六小虎"(智谱、月之暗面、MiniMax、DeepSeek、阶跃星辰、零一万物)中,已有四家完成了不同程度的价格上调。
影响与意义
MiniMax 的涨价,进一步确认了独立大模型厂商集体提价的行业趋势。这些厂商的共同特点是: - 没有自有算力基础设施,需要向云厂商采购 GPU - 推理成本高企,低价策略难以持续 - 模型能力持续提升,有涨价的产品基础
从更深层看,这轮涨价是对"推理算力成本倒挂"的修正。此前为了抢占市场,各家厂商的定价普遍低于实际成本,处于"赔本赚吆喝"的状态。随着商业化进入深水区,厂商必须让价格回归到合理水平,才能实现可持续发展。
5. 阿里、腾讯、字节按兵不动:自有算力才是终极护城河?
发布方:阿里、腾讯、字节跳动
核心亮点:在独立厂商集体涨价的背景下,拥有自有算力的互联网大厂却保持价格稳定,形成鲜明对比。
事件详情
与智谱、月之暗面、MiniMax、DeepSeek 纷纷涨价形成鲜明对比的是,阿里(通义千问 Qwen)、腾讯(混元)、字节(豆包)等拥有自有算力的大厂,在价格上按兵不动或仅进行变相调价。
致同咨询合伙人梁伟的观点一针见血:"这轮不是全行业统一涨价,而是独立模型厂商领涨,自有算力的大厂按兵不动或变相调价。"
价格对比一览
为了更直观地展示当前国内大模型的价格格局,我们整理了主要模型的价格对比:
| 厂商 | 旗舰模型 | 输入价格(元/百万 tokens) | 输出价格(元/百万 tokens) | 价格定位 |
|---|---|---|---|---|
| 月之暗面 | Kimi K3 | 20 | 100 | 旗舰高价 |
| 智谱 AI | GLM-5.3 Max | 8 | 28 | 中高端 |
| 智谱 AI | GLM-5 | 4~6 | 18~22 | 中端 |
| DeepSeek | V4 Pro(高峰) | 9 | 27 | 峰谷定价 |
| DeepSeek | V4 Pro(低谷) | 4.5 | 13.5 | 峰谷定价 |
| 阿里 | Qwen3.8 Max | - | - | 大厂稳定 |
| 腾讯 | 混元-TurboS | - | ~2 | 低价路线 |
| MiniMax | M3 | - | - | 翻倍后 |
影响与意义
大厂按兵不动,可能才是这轮涨价潮中最值得玩味的信号。
正方观点认为:涨价是国产模型走出价格战底部的标志,敢收钱说明客户粘性真实存在,是对推理算力成本长期倒挂的修正。
反方观点则认为:大厂按兵不动才是最狠的杀招——阿里、腾讯、字节自己有算力有场景,可以一直用"免费/低价"拖住价格敏感客户。独立厂商涨价等于主动把用户让出去,而模型间的替换成本在下降,只提价不匹配新能力,用户会用脚投票。
两种观点都有道理。最终的胜负,不看涨价公告,而看续费率——涨价之后,客户是留还是走,这才是检验模型价值的终极标准。
趋势总结与展望
2026 年的国内大模型市场,正在经历一场深刻的结构性变化:
第一,价格分层格局基本形成。 从混元-TurboS 输出 ¥2/百万 tokens 的低价,到 Kimi K3 输出 ¥100/百万 tokens 的高价,中间相差 50 倍。这说明国内大模型不再是"一个市场",而是分化成了多个定位不同的细分市场。开发者需要根据场景需求选择合适的模型,而不是盲目追求"最强"或"最便宜"。
第二,独立厂商与大厂的路线分化加剧。 独立厂商(智谱、月之暗面、MiniMax、DeepSeek)选择通过涨价改善盈利状况,走"小而美"的精品路线;大厂(阿里、腾讯、字节)则凭借自有算力优势保持低价,用大模型赋能自身业务生态。两条路线各有逻辑,未来可能会长期共存。
第三,峰谷定价可能成为行业新标准。 DeepSeek 的峰谷定价机制,如果被市场验证有效,很可能会被其他厂商效仿。这种动态定价方式既能优化算力利用效率,又能给用户提供成本优化空间,是一种双赢的定价模式。
第四,价格战转向"价值战"。 本轮涨价潮说明,单纯的低价竞争已经走到尽头。用户更看重模型的实际能力、稳定性、安全性和生态完整性。未来的竞争,将从"谁更便宜"转向"谁能创造更多价值"。
对于开发者和企业用户,我们的建议是: 1. 建立多模型策略,不要绑定单一厂商,根据场景选择最优模型 2. 精细化成本管理,利用缓存、峰谷定价等手段优化调用成本 3. 关注模型性价比而非绝对价格,最贵的不一定最适合,最便宜的也不一定总成本最低
大模型行业正在从"野蛮生长"走向"精耕细作",这对整个行业的健康发展来说,是一件好事。
数据来源
- 21 世纪经济报道 - 国产大模型集体涨价专题(2026.8.22)
- 央视财经 - DeepSeek 调价正式生效!采用峰谷定价
- 凤凰网 - DeepSeek"峰谷调价"背后 Token 经济正在发生什么
- 国金证券研报 - 大模型行业分析
- 腾讯云 TokenHub 模型价格公示
- llm-token.cn - 模型价格广场
- 各厂商官方定价页面及公告

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论