国内大模型最新动态与价格变化(2026年9月14日):DeepSeek降价、Qwen3.8发布与GLM-5.3迭代

国内大模型最新动态与价格变化(2026年9月14日):DeepSeek降价、Qwen3.8发布与GLM-5.3迭代

Author: zhiqiu16 | Create: 2026-09-14 15:08:27 | Update: 2026-09-14 15:08:27 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

国内大模型最新动态与价格变化(2026年9月14日)

本期导读:DeepSeek V4-Flash系列最高降价60%并引入峰谷计费;阿里通义千问Qwen3.8-Max以2.4万亿参数登顶开源榜单;智谱GLM-5.3系列持续快速迭代并完成约50亿美元融资;Kimi K3、MiniMax等厂商探索"电商化"售卖模式。以下是本周国内大模型最重要的5条动态。


一、DeepSeek V4-Flash最高降价60%,国内首次引入峰谷计费

发布方:DeepSeek(深度求索)
核心事件:DeepSeek宣布自9月10日12:00起,V4-Flash系列模型价格大幅下调,最高降幅达60%,并首次在国内大模型行业引入"峰谷计费"机制。定位更高的V4-Pro价格维持不变。

核心亮点: - V4-Flash系列输入价格大幅下调,最低至0.15美元/百万token(约1元人民币) - 峰谷计费机制:高峰时段(北京时间周一至周五 9:00-12:00、14:00-18:00)按基准价计费;空闲时段(含周末全天)按低谷价计费,降幅显著 - 此前8月13日DeepSeek已调整过一次高峰时段价格,输入价从1元/百万token提升至3-9元,缓存命中价从0.02元涨至0.1-0.3元 - 8月23日补充规则:周末全天按低谷价计算,一定程度上缓解了涨价影响

调整前后价格对比(V4-Flash系列)

计费项 调整前(空闲时段) 调整后(空闲时段) 调整前(高峰时段) 调整后(高峰时段)
输入(未命中缓存) 约1元/百万token 约0.4元/百万token 3-9元/百万token 3-9元/百万token
输入(缓存命中) 0.02元/百万token 0.01元/百万token 0.1-0.3元/百万token 0.1-0.3元/百万token
输出 约0.6元/百万token 约0.24元/百万token 维持基准 维持基准

注:以上价格为示意,具体以官方公告为准。V4-Pro价格不受本次调整影响。

影响与意义: DeepSeek的"先涨后降+峰谷计费"组合拳,本质上是在用价格杠杆调节算力负载。对于开发者而言,合理规划调用时段可显著降低成本;对于行业而言,这标志着国内大模型定价正从"一刀切"走向"精细化运营"。值得注意的是,V4-Pro维持原价,说明厂商正通过分层定价区分"普惠型"与"旗舰型"用户。


二、阿里通义千问Qwen3.8-Max发布:2.4万亿参数、百万上下文

发布方:阿里云 / 通义千问团队
核心事件:8月初,阿里云正式发布通义千问最新旗舰模型 Qwen3.8-Max,随后又于8月26日开源了 Qwen3.8-Flash。该系列采用稀疏MoE架构,总参数达2.4万亿,每步激活约950亿参数,支持100万token超长上下文。

核心亮点: - Qwen3.8-Max:2.4T总参数,95B激活参数,1M上下文窗口,混合思考模式(默认开启),编程、办公、科研能力全面提升 - Qwen3.8-Flash:多模态MoE模型,轻量化版本,已同步开源模型权重 - 在三方机构Arena全球大模型盲测总榜中,Qwen3.7-Max曾超过Kimi-K2.6、DeepSeek-V4-Pro和GLM-5.1,位列中国模型第一 - 千问AI平台已全面上线3.8系列模型API,阿里云百炼平台同步支持

影响与意义: Qwen3.8系列的最大意义在于"开源+闭源"双线并进。Max版本对标国际顶尖闭源模型,Flash版本则以开源形式降低使用门槛。2.4万亿参数的规模已逼近当前已知最大开源模型的上限,这意味着国内模型在"参数规模竞赛"中已不落下风。但随之而来的推理成本和部署难度,也将成为企业和开发者面临的现实挑战。


三、智谱GLM-5.3系列迭代加速,完成约50亿美元融资

发布方:智谱AI(Zhipu AI)
核心事件:智谱AI于2026年8月发布并开源了GLM-5.3-Flash,同时完成约50亿美元融资,用于下一代GLM模型与算力建设。

核心亮点: - GLM-5.3:753B总参数,40B激活,1M无损上下文,智能指数达60分(据第三方评测) - GLM-5.3-Flash:320B总参数,18B激活,原生多模态能力,定价仅为GLM-5.3的十分之一,号称用1/40的成本把前沿多模态能力拉进普惠区间 - 迭代速度惊人:2026年2月至8月先后推出GLM-5、GLM-5.1、GLM-5.2、GLM-5.3,保持约每两个月一次重要升级 - 智谱管理层透露,下一代GLM-6.0将定义为"自进化"模型,重点提升推理能力

影响与意义: 智谱是国内大模型迭代节奏最快的厂商之一。"约每两月一更"的速度不仅体现了工程能力,更反映出对"模型即产品"理念的坚持。50亿美元融资将为其算力扩张和下一代研发提供充足弹药。GLM-5.3-Flash的"十分之一定价"策略,也显示出智谱在"高端市场立品牌、中低端市场抢份额"的双线布局。


四、Kimi K3定价体系解析:国产模型也进入"高价时代"

发布方:月之暗面(Moonshot AI)
核心事件:Kimi K3作为月之暗面的最新旗舰模型,自发布以来其定价策略引发广泛关注。输入$3/百万token、输出$15/百万token的API定价,以及99元-699元的订阅分层,标志着国产模型已告别"低价抢市场"阶段。

核心亮点: - API定价:输入$3.00/百万token(缓存命中$0.30),输出$15.00/百万token,推理token按输出价计费(实测占输出的43%-77%) - 订阅分层:Moderato套餐99元/月可用K3模型;Allegretto套餐199元/月解锁最高1M上下文;Allegro套餐699元/月体验百万token超长对话 - 第三方评测机构Artificial Analysis测得单任务成本约0.94美元,接近GPT-5.6 Sol的1.04美元 - 月之暗面同时推出"电商化"售卖模式:33元月卡含165万Tokens,55元Pro月卡含275万Tokens

影响与意义: K3的定价与国际一线模型已处于同一量级,这说明国产模型在能力自信上有了质的提升。但"不便宜"也意味着用户会更严格地评估投入产出比。月之暗面的"词元月卡"模式是一种有趣的尝试——将AI服务包装成类似"话费充值"的消费品,降低了用户的心理门槛,但长期能否形成粘性仍需观察。


五、MiniMax H3视频模型与"大模型电商化"趋势

发布方:MiniMax(稀宇科技)
核心事件:MiniMax于7月30日发布海螺3(Hailuo 3)视频生成模型H3,支持原生2K输出、立体声生成、指令式编辑和多模态参考输入。与此同时,MiniMax与Kimi等厂商开始探索将大模型服务搬上电商货架。

核心亮点: - H3 Max:基于H3开源权重后训练的强化版本,5秒768P视频3秒出片,速度与质量并重 - 视频生成定价:768P/6秒约2元/次,1080P/6秒约3.5元/次,1080P/10秒约4元/次 - 月付套餐9.9美元起(年付半价),积分包永不过期 - "电商化"趋势:Kimi、MiniMax等在电商渠道推出"Token月卡",像充话费一样买AI

影响与意义: MiniMax H3代表着国内多模态大模型在视频生成领域的最新进展。与文本模型不同,视频模型的竞争维度更多——分辨率、时长、声画同步、编辑可控性都是关键指标。而"电商化"售卖模式的兴起,则反映出大模型行业正在从"B端API调用"向"C端零售消费"拓展。这种"AI即商品"的思路,或许将成为下一轮用户增长的重要引擎。


趋势总结与展望

2026年9月的国内大模型市场呈现出三大趋势:

1. 价格战进入"精细化运营"阶段。DeepSeek的峰谷计费、智谱的"十分之一定价"、Kimi的"词元月卡"——各家不再简单追求"全网最低价",而是通过分层、分时、分场景的策略实现差异化竞争。这意味着开发者和企业需要更精细地计算成本,"选对时机"可能比"选对模型"更省钱。

2. 参数规模与多模态并进。Qwen3.8的2.4万亿参数、GLM-5.3的原生多模态、MiniMax H3的2K视频生成——国内模型在"硬指标"上已全面对标国际水平。下一步的竞争焦点将从"能不能做"转向"做得好不好、用得起用不起"。

3. 商业模式从B端向C端延伸。"电商化"售卖、订阅分层、积分包——大模型厂商正在学习互联网产品的运营逻辑。对于普通用户而言,AI正在从"专业工具"变成"日常消费品"。

下期关注:智谱GLM-6.0动态、Kimi K3后续调价、DeepSeek V4-Pro是否会跟进降价、MiniMax H3多模态能力扩展。


数据来源:阿里云百炼平台、千问AI平台、智谱AI开放平台、MiniMax开放平台、DeepSeek官方公告、36氪、虎嗅网、CSDN等公开信息。信息整理于2026年9月14日。

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.