国内大模型最新动态与价格变化(2026年9月15日)

国内大模型最新动态与价格变化(2026年9月15日)

Author: zhiqiu16 | Create: 2026-09-15 15:10:38 | Update: 2026-09-15 15:10:38 | 分类:大模型

MiniMax价格动态GLMKimiQwen行业动态大模型

国内大模型最新动态与价格变化(2026年9月15日)

总览

2026年9月,国产大模型市场呈现出"开源普惠"与"订阅涨价"并存"价格探底"与"生态重构"交织的复杂图景。一方面,智谱、阿里等头部厂商通过开源轻量模型将API价格压至极低水平;另一方面,智谱的Coding Plan订阅套餐却大幅涨价,最高涨幅超过260%。与此同时,DeepSeek坚持峰谷定价策略,Kimi K3以百万级上下文切入高端市场,而整个行业的竞争逻辑正从"拼价格"悄然转向"拼生态"。本期整理5条国内最重要的动态,并附详细价格对比。


一、智谱GLM-5.3-Flash开源:320B总参、18B激活,价格仅为旗舰十分之一

发布方: 智谱AI(Zhipu AI)
核心亮点:

8月26日,智谱发布并开源GLM-5.3-Flash,采用320B总参数、18B激活的稀疏MoE架构,MIT协议开放权重。该模型为原生多模态版本,在匿名测试期间全部流量运行在10万张国产芯片上,通过SGLang推理引擎将单token成本压至与主流GPU相当的水平。

定价方面,GLM-5.3-Flash的官方按量价格为输入0.8元/百万token、输出约2.8元/百万token,叠加限时5折优惠后(至9月9日截止)仅为输入0.4元、输出1.4元。作为对比,旗舰模型GLM-5.3的定价是其十倍以上。单次AA智能指数任务成本约0.09美元,而Claude Opus 4.8约为2美元。

影响与意义: - 国产开源模型首次在超大规模参数上实现如此激进的定价 - 全部跑在国产芯片上的验证,标志着国产算力生态的成熟度大幅提升 - MIT协议的采用为下游商业化提供了最大自由度,有助于构建开发者生态


二、阿里Qwen3.8-Flash发布:千亿参数仅激活6B,效率创下全球新基准

发布方: 阿里云(通义千问团队)
核心亮点:

同样在8月26日,阿里发布并开源Qwen3.8-Flash。该模型采用全新下一代架构,总参数达千亿级别,但每步仅激活约60亿(6B)参数,即可获得超越Claude Opus 4.6的前沿性能。得益于架构和训练的全面革新,其训练成本较Qwen3.7-Plus骤降近90%。

在价格方面,Qwen3.8-Flash与GLM-5.3-Flash几乎持平:输入约0.8元、输出约2.7-2.8元/百万token,双双站上行业最低档。阿里同期还开源了旗舰系列的2.4万亿参数版本Qwen3.8-2.4T-A95B(每步激活约950亿),支持100万token上下文窗口。

影响与意义: - "大参数、小激活"的稀疏架构成为国产模型效率竞赛的主流路线 - 训练成本下降90%意味着模型迭代速度将大幅加快,后续版本推出周期有望缩短 - 阿里与智谱在同一天发布同级别开源模型,国产大模型"双雄争霸"格局愈发清晰


三、Kimi K3正式发布:百万token上下文,输出定价$15/百万token

发布方: 月之暗面(Moonshot AI)
核心亮点:

月之暗面正式发布Kimi K3,支持最高100万token上下文窗口,采用1T总参数的MoE架构(每步激活32B)。与Kimi K2.6的256K上下文相比,K3在长文档处理、大型代码库分析和多轮对话场景上具有显著优势。

API定价方面,K3的官方价格为: - 缓存命中输入:$0.30/百万token - 缓存未命中输入:$3.00/百万token - 输出:$15.00/百万token

作为对比,Kimi K2.6的定价为$0.95/$4.00,K3的输出价格接近K2.6的4倍,反映了长上下文生成的高算力成本。订阅套餐方面,K3会员月付49-699元不等,年付方案有折扣。

影响与意义: - 百万token上下文正式成为国产大模型的"标配"能力,将推动法律、金融、科研等长文档密集型场景的AI应用落地 - 高昂的输出定价表明,月之暗面选择走"能力溢价"路线,与价格战保持一定距离 - K3与Claude Fable 5.1($10/$50)形成直接竞争,高端模型市场格局正在重塑


四、智谱Coding Plan订阅价格大涨,最高涨幅超260%

发布方: 智谱AI
核心亮点:

与国际API价格战形成鲜明对比的是,智谱在8月对GLM Coding Plan订阅套餐进行了大幅提价:

套餐档位 旧版月费 新版月费 涨幅
Lite 49元 118元 +141%
Pro 149元 538元 +261%
Max 469元 1078元 +130%

新版套餐的积分额度计算方式也发生了变化,采用5小时动态刷新+7天周期的双窗口机制。与此同时,智谱官方强调老用户权益保障,已订阅用户在一定周期内可维持原有价格。

影响与意义: - 订阅涨价与API降价的"剪刀差"表明,智谱正在将C端付费产品向高价值用户集中,同时通过低价API扩大开发者覆盖 - 超过260%的涨幅在行业内极为罕见,可能引发用户对国产AI工具付费意愿的重新评估 - 团队版已于9月5日起暂停新购,智谱可能在酝酿面向企业的全新定价体系


五、国产大模型竞争逻辑换挡:从"拼价格"转向"拼生态"

发布方: 行业综合分析
核心亮点:

据《证券日报》和中国经济网等媒体报道,国产大模型正经历一轮前所未有的密集调价,但业内人士普遍认为,这一轮调整并非简单的价格战,而是行业竞争逻辑的深刻转变——从"卖能力"走向"卖服务",从"拼价格"转向"拼生态"。

具体表现为: - DeepSeek坚持峰谷定价策略,Flash系列闲时输入低至0.05元/百万token,同时通过时间差异化平衡算力负载 - MiniMax持续发力视频生成领域,海螺H3系列在7月发布后已形成文生视频、图生视频的完整产品矩阵 - 各大厂商纷纷加码智能体(Agent)生态建设,长上下文、工具调用、多模态成为标配能力

影响与意义: - 纯价格竞争的边际效应正在递减,模型厂商需要在工具链、开发者社区、行业解决方案等维度建立护城河 - 峰谷定价、订阅分层、按量付费等多元化定价模式的出现,标志着市场正在成熟和细分 - 随着智能体应用需求的爆发,大模型的竞争将从"模型本身"延伸到"Agent生态"的全栈能力


国内主流大模型API价格对比(截至2026年9月15日)

厂商 模型 输入价格(元/百万token) 输出价格(元/百万token) 上下文长度 备注
智谱 GLM-5.3-Flash 0.4(5折后)/ 0.8(原价) 1.4(5折后)/ 2.8(原价) 128K 开源,MIT协议
阿里 Qwen3.8-Flash ~0.8 ~2.7-2.8 128K 开源
阿里 Qwen3.8-Max ~11.5 ~34.5 1M 旗舰模型
DeepSeek V4.1-Flash ~1.1(闲时)/ ~2.2(高峰) ~4.2(闲时)/ ~8.4(高峰) 1M 峰谷定价
月之暗面 Kimi K3 ~21(缓存未命中) ~105 1M 百万上下文
月之暗面 Kimi K2.6 ~6.7 ~28 256K -

注:表格中美元价格按1美元≈7元人民币估算。实际价格以各平台官方公示为准。


趋势总结与展望

当前国内大模型市场呈现三大趋势:

  1. 开源模型成为流量入口:智谱和阿里通过极低定价甚至开源策略抢占开发者心智,意图在生态层面建立标准
  2. 定价策略显著分化:API端持续探底,订阅端逆势上涨,峰谷定价、分层服务等精细化运营手段开始普及
  3. 长上下文成为新战场:从K3的1M到Qwen3.8-2.4T-A95B的1M,百万token上下文正在从"差异化卖点"变为"基础能力"

展望未来,随着Agent应用的爆发,国产大模型的竞争将更多体现在工具调用可靠性多模态融合能力行业解决方案深度上。单纯的价格战将让位于生态体系的综合较量。


数据来源: 智谱AI开放平台、阿里云百炼、DeepSeek官方、月之暗面官网、llmrates.ai、中国经济网、证券日报、36氪等。信息整理于2026年9月15日。

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.