国内大模型最新动态与价格变化(2026年9月15日)
总览
2026年9月,国产大模型市场呈现出"开源普惠"与"订阅涨价"并存、"价格探底"与"生态重构"交织的复杂图景。一方面,智谱、阿里等头部厂商通过开源轻量模型将API价格压至极低水平;另一方面,智谱的Coding Plan订阅套餐却大幅涨价,最高涨幅超过260%。与此同时,DeepSeek坚持峰谷定价策略,Kimi K3以百万级上下文切入高端市场,而整个行业的竞争逻辑正从"拼价格"悄然转向"拼生态"。本期整理5条国内最重要的动态,并附详细价格对比。
一、智谱GLM-5.3-Flash开源:320B总参、18B激活,价格仅为旗舰十分之一
发布方: 智谱AI(Zhipu AI)
核心亮点:
8月26日,智谱发布并开源GLM-5.3-Flash,采用320B总参数、18B激活的稀疏MoE架构,MIT协议开放权重。该模型为原生多模态版本,在匿名测试期间全部流量运行在10万张国产芯片上,通过SGLang推理引擎将单token成本压至与主流GPU相当的水平。
定价方面,GLM-5.3-Flash的官方按量价格为输入0.8元/百万token、输出约2.8元/百万token,叠加限时5折优惠后(至9月9日截止)仅为输入0.4元、输出1.4元。作为对比,旗舰模型GLM-5.3的定价是其十倍以上。单次AA智能指数任务成本约0.09美元,而Claude Opus 4.8约为2美元。
影响与意义: - 国产开源模型首次在超大规模参数上实现如此激进的定价 - 全部跑在国产芯片上的验证,标志着国产算力生态的成熟度大幅提升 - MIT协议的采用为下游商业化提供了最大自由度,有助于构建开发者生态
二、阿里Qwen3.8-Flash发布:千亿参数仅激活6B,效率创下全球新基准
发布方: 阿里云(通义千问团队)
核心亮点:
同样在8月26日,阿里发布并开源Qwen3.8-Flash。该模型采用全新下一代架构,总参数达千亿级别,但每步仅激活约60亿(6B)参数,即可获得超越Claude Opus 4.6的前沿性能。得益于架构和训练的全面革新,其训练成本较Qwen3.7-Plus骤降近90%。
在价格方面,Qwen3.8-Flash与GLM-5.3-Flash几乎持平:输入约0.8元、输出约2.7-2.8元/百万token,双双站上行业最低档。阿里同期还开源了旗舰系列的2.4万亿参数版本Qwen3.8-2.4T-A95B(每步激活约950亿),支持100万token上下文窗口。
影响与意义: - "大参数、小激活"的稀疏架构成为国产模型效率竞赛的主流路线 - 训练成本下降90%意味着模型迭代速度将大幅加快,后续版本推出周期有望缩短 - 阿里与智谱在同一天发布同级别开源模型,国产大模型"双雄争霸"格局愈发清晰
三、Kimi K3正式发布:百万token上下文,输出定价$15/百万token
发布方: 月之暗面(Moonshot AI)
核心亮点:
月之暗面正式发布Kimi K3,支持最高100万token上下文窗口,采用1T总参数的MoE架构(每步激活32B)。与Kimi K2.6的256K上下文相比,K3在长文档处理、大型代码库分析和多轮对话场景上具有显著优势。
API定价方面,K3的官方价格为: - 缓存命中输入:$0.30/百万token - 缓存未命中输入:$3.00/百万token - 输出:$15.00/百万token
作为对比,Kimi K2.6的定价为$0.95/$4.00,K3的输出价格接近K2.6的4倍,反映了长上下文生成的高算力成本。订阅套餐方面,K3会员月付49-699元不等,年付方案有折扣。
影响与意义: - 百万token上下文正式成为国产大模型的"标配"能力,将推动法律、金融、科研等长文档密集型场景的AI应用落地 - 高昂的输出定价表明,月之暗面选择走"能力溢价"路线,与价格战保持一定距离 - K3与Claude Fable 5.1($10/$50)形成直接竞争,高端模型市场格局正在重塑
四、智谱Coding Plan订阅价格大涨,最高涨幅超260%
发布方: 智谱AI
核心亮点:
与国际API价格战形成鲜明对比的是,智谱在8月对GLM Coding Plan订阅套餐进行了大幅提价:
| 套餐档位 | 旧版月费 | 新版月费 | 涨幅 |
|---|---|---|---|
| Lite | 49元 | 118元 | +141% |
| Pro | 149元 | 538元 | +261% |
| Max | 469元 | 1078元 | +130% |
新版套餐的积分额度计算方式也发生了变化,采用5小时动态刷新+7天周期的双窗口机制。与此同时,智谱官方强调老用户权益保障,已订阅用户在一定周期内可维持原有价格。
影响与意义: - 订阅涨价与API降价的"剪刀差"表明,智谱正在将C端付费产品向高价值用户集中,同时通过低价API扩大开发者覆盖 - 超过260%的涨幅在行业内极为罕见,可能引发用户对国产AI工具付费意愿的重新评估 - 团队版已于9月5日起暂停新购,智谱可能在酝酿面向企业的全新定价体系
五、国产大模型竞争逻辑换挡:从"拼价格"转向"拼生态"
发布方: 行业综合分析
核心亮点:
据《证券日报》和中国经济网等媒体报道,国产大模型正经历一轮前所未有的密集调价,但业内人士普遍认为,这一轮调整并非简单的价格战,而是行业竞争逻辑的深刻转变——从"卖能力"走向"卖服务",从"拼价格"转向"拼生态"。
具体表现为: - DeepSeek坚持峰谷定价策略,Flash系列闲时输入低至0.05元/百万token,同时通过时间差异化平衡算力负载 - MiniMax持续发力视频生成领域,海螺H3系列在7月发布后已形成文生视频、图生视频的完整产品矩阵 - 各大厂商纷纷加码智能体(Agent)生态建设,长上下文、工具调用、多模态成为标配能力
影响与意义: - 纯价格竞争的边际效应正在递减,模型厂商需要在工具链、开发者社区、行业解决方案等维度建立护城河 - 峰谷定价、订阅分层、按量付费等多元化定价模式的出现,标志着市场正在成熟和细分 - 随着智能体应用需求的爆发,大模型的竞争将从"模型本身"延伸到"Agent生态"的全栈能力
国内主流大模型API价格对比(截至2026年9月15日)
| 厂商 | 模型 | 输入价格(元/百万token) | 输出价格(元/百万token) | 上下文长度 | 备注 |
|---|---|---|---|---|---|
| 智谱 | GLM-5.3-Flash | 0.4(5折后)/ 0.8(原价) | 1.4(5折后)/ 2.8(原价) | 128K | 开源,MIT协议 |
| 阿里 | Qwen3.8-Flash | ~0.8 | ~2.7-2.8 | 128K | 开源 |
| 阿里 | Qwen3.8-Max | ~11.5 | ~34.5 | 1M | 旗舰模型 |
| DeepSeek | V4.1-Flash | ~1.1(闲时)/ ~2.2(高峰) | ~4.2(闲时)/ ~8.4(高峰) | 1M | 峰谷定价 |
| 月之暗面 | Kimi K3 | ~21(缓存未命中) | ~105 | 1M | 百万上下文 |
| 月之暗面 | Kimi K2.6 | ~6.7 | ~28 | 256K | - |
注:表格中美元价格按1美元≈7元人民币估算。实际价格以各平台官方公示为准。
趋势总结与展望
当前国内大模型市场呈现三大趋势:
- 开源模型成为流量入口:智谱和阿里通过极低定价甚至开源策略抢占开发者心智,意图在生态层面建立标准
- 定价策略显著分化:API端持续探底,订阅端逆势上涨,峰谷定价、分层服务等精细化运营手段开始普及
- 长上下文成为新战场:从K3的1M到Qwen3.8-2.4T-A95B的1M,百万token上下文正在从"差异化卖点"变为"基础能力"
展望未来,随着Agent应用的爆发,国产大模型的竞争将更多体现在工具调用可靠性、多模态融合能力和行业解决方案深度上。单纯的价格战将让位于生态体系的综合较量。
数据来源: 智谱AI开放平台、阿里云百炼、DeepSeek官方、月之暗面官网、llmrates.ai、中国经济网、证券日报、36氪等。信息整理于2026年9月15日。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论