总览
2026年9月,国内大模型市场延续了激烈的价格竞争态势,同时在模型能力迭代和资本运作方面也有重要进展。DeepSeek再度引领降价潮,阿里以Qwen3.8-Flash的极致性价比强势入局,月之暗面则凭借Kimi K3的亮眼表现加速冲刺港股IPO。智谱GLM-5.3在编程能力上实现开源模型第一,国内大模型生态正呈现出"技术迭代加速、价格持续下探、资本动作频繁"的三重特征。
一、DeepSeek再度降价,发布V4.1 Flash
事件名称:DeepSeek V4.1 Flash发布及Flash系列API价格下调 发布方/来源:DeepSeek官方开放平台
核心亮点: - 9月9日,DeepSeek开放平台公告,自9月10日12时起对Flash系列模型降价 - 9月10日前后,DeepSeek正式发布V4.1 Flash模型,官方称在性能、费用、速度、总用时等各项指标上全面超越V4 Pro - 价格调整详情:
| 时段 | 缓存命中输入 | 未命中输入 | 输出 |
|---|---|---|---|
| 非高峰时段 | 0.02元/百万Tokens | 1元/百万Tokens | 4元/百万Tokens |
| 高峰时段 | 0.04元/百万Tokens | 2元/百万Tokens | 8元/百万Tokens |
- 高峰时段价格为非高峰时段的两倍
影响与意义: DeepSeek延续了其"价格屠夫"的策略,非高峰时段0.02元/百万Tokens的缓存命中输入价格已接近免费。这一激进定价策略虽然吸引了大量个人开发者和中小企业用户,但也引发了对ARR(年度经常性收入)可持续性的质疑。值得注意的是,DeepSeek在8月曾有一轮涨价,导致性价比优势减弱,此次降价可视为对市场竞争的回应。
二、阿里Qwen3.8-Flash发布:性价比挑战DeepSeek
事件名称:阿里云发布并开源Qwen3.8-Flash 发布方/来源:阿里云/通义千问团队
核心亮点: - 阿里发布并开源Qwen3.8-Flash,通过新的架构和训练方式大幅降低训练成本 - 定价策略:每百万Tokens输入价格1元、输出3元,最低可至DeepSeek V4 Flash的1/3 - Qwen3.8-2.4T-A95B(8月发布):采用稀疏MoE架构,总参数2.4万亿,每步激活约950亿,为通义千问最新旗舰系列的开源版本 - 9月2日,阿里更新了Qwen3.8-Max模型
影响与意义: 阿里以Qwen3.8-Flash的极致性价比直接向DeepSeek发起挑战,每百万Tokens输入1元、输出3元的定价在主流厂商中极具竞争力。作为国内云计算基础设施的最大提供商,阿里在算力成本和渠道分发上拥有天然优势,其大模型价格策略将对整个国内API市场产生深远影响。开源策略的持续推进,也有助于阿里建立更广泛的开发者生态。
三、月之暗面Kimi K3:冲刺500亿美元估值与港股IPO
事件名称:月之暗面推进Pre-IPO轮融资及香港上市计划 发布方/来源:月之暗面/36氪/路透社
核心亮点: - Kimi K3:月之暗面迄今发布的最全能模型,原生多模态架构设计,支持视觉与文本输入、思考与非思考模式、对话与Agent任务,上下文长度最高达1M - 融资进展:公司7月完成超35亿美元的F轮融资,投后估值达350亿美元,认购金额超出原定目标逾3倍 - Pre-IPO轮:公司正以500亿美元投前估值推进新一轮融资,可能是IPO前最后一轮私募融资 - 港股IPO:公司已以保密形式向港交所递交A1文件,计划最早于2027年第一季度挂牌,目标年销售额20亿美元
影响与意义: 从43亿美元到500亿美元估值,月之暗面仅用时8个月,增速令人瞩目。Kimi K3的多模态能力和长上下文支持,使其在知识工作、前端开发和3D生成等场景具有独特优势。港股IPO的推进将为国内大模型企业的资本化路径提供重要参照。不过,随着国内大模型价格战的持续加剧,月之暗面如何在低价竞争环境中实现20亿美元年销售额目标,仍是重大挑战。
四、智谱GLM-5.3:编程能力开源第一
事件名称:智谱AI发布GLM-5.3模型 发布方/来源:智谱AI
核心亮点: - GLM-5.3基于GLM-5.2基座,通过后训练持续放大模型能力上限 - 编程能力:较前代提升50%,在Terminal Bench 3.0基准取得开源模型第一,性能接近Claude Fable 5 - 网络安全能力:在白盒代码审查与漏洞发现等安全任务中,表现持平Mythos 5 - 定价策略:未缓存输入8元/百万Tokens,缓存输入2元/百万Tokens,输出28元/百万Tokens,上下文1M - 智谱GLM订阅入门价格94.4元/月起,连续包季8折/包年7折
影响与意义: GLM-5.3在编程能力上的突破,使智谱在国内开源模型阵营中占据了技术制高点。在代码审查和漏洞挖掘场景的表现,也使其在企业级安全领域具有独特竞争力。不过,智谱近期因两个月内募资700亿引发争议,前次配售价腰斩后仍继续伸手,市场对其ARR可持续性存在疑虑。
五、MiniMax:阿拉伯语大模型背后的技术输出
事件名称:沙特HUMAIN基于MiniMax M3发布阿拉伯语大模型 发布方/来源:沙特公共投资基金旗下HUMAIN
核心亮点: - 9月3日,沙特公共投资基金旗下AI公司HUMAIN发布了全球首个阿拉伯语大模型 - 该模型基于MiniMax开源模型M3进行后训练 - 这是国内大模型技术首次以基础模型形式输出到中东市场
影响与意义: 虽然MiniMax本月没有发布重大模型更新,但其M3模型成为沙特首个阿拉伯语大模型的技术底座,标志着中国大模型技术开始走向全球市场。在当前的国内价格战环境下,技术输出和海外授权可能成为大模型厂商的重要收入来源之一。
国内大模型API价格对比表
| 厂商 | 旗舰模型 | 未缓存输入 | 缓存输入 | 输出 | 上下文 | 主要优势 |
|---|---|---|---|---|---|---|
| 阿里 | Qwen3.8-Max | 12元 | 1.5元 | 36元 | 1M | 中文、办公、编程、多模态均衡 |
| 月之暗面 | Kimi K3 | 20元 | 2元 | 100元 | 最高1M | 长文档、研究、前端、3D |
| 智谱 | GLM-5.3 | 8元 | 2元 | 28元 | 1M | Agent编程、终端、长程任务 |
| DeepSeek | V4.1 Flash | 1元(非高峰) | 0.02元(非高峰命中) | 4元(非高峰) | - | 极致性价比、速度 |
| 阿里 | Qwen3.8-Flash | 1元 | - | 3元 | - | 极致性价比、开源 |
注:价格为每百万Tokens,单位人民币;DeepSeek价格为非高峰时段
趋势总结与展望
本周国内大模型领域呈现三大趋势:
-
价格战进入"分时代":DeepSeek非高峰时段缓存命中输入价格已降至0.02元/百万Tokens,阿里Qwen3.8-Flash输入仅1元/百万Tokens,大模型API正逐步接近"水电煤"的公共资源定价模式
-
技术差异化成为生存关键:在价格难以进一步下探的情况下,Kimi K3的长上下文和多模态能力、GLM-5.3的编程能力、Qwen的MoE架构效率,成为各厂商寻求差异化的核心方向
-
资本化进程加速:月之暗面冲刺500亿美元估值和港股IPO,智谱两个月募资700亿,国内头部大模型企业正在通过资本市场补充弹药,为长期价格战储备资源
展望未来,随着Qwen3.8系列的开源生态扩张和Kimi K3的商业化推进,国内大模型市场可能迎来新一轮格局重塑。但在价格持续压缩的背景下,如何实现技术投入与商业回报的平衡,将是所有厂商面临的共同挑战。
数据来源:各厂商官方开放平台、36氪、蓝鲸新闻、CSDN、LLMRates.ai、DataLearnerAI等 整理时间:2026年9月14日

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论