国内大模型最新动态与价格变化(2026年9月17日)
总览
2026年9月17日,国内大模型市场呈现出"应用落地加速、价格分化加剧"的双重特征。火山引擎当日正式发布"豆包座舱助手",标志着大模型开始向智能汽车座舱这一高价值场景渗透;DeepSeek近期大幅下调Flash系列API价格,闲时输入降幅高达60%,引发新一轮价格连锁反应;与此同时,国产大模型的价格梯队已明显分化,经济型模型的输入价格普遍降至1元/百万Token以下,而高端模型仍保持较高溢价。整体来看,国内大模型竞争逻辑正从早期的"拼价格"向"拼生态、拼场景、拼服务"深度转型。
一、火山引擎发布"豆包座舱助手",大模型驶入智能汽车
发布方: 字节跳动 / 火山引擎
核心亮点:
9月17日,火山引擎正式发布"豆包座舱助手",由豆包大模型与火山引擎联合打造。该产品具备三大核心能力:一是理解复杂需求并联动全车功能,实现语音控制与车辆系统的深度整合;二是自然参与多人交流,记住每位乘客的习惯偏好;三是与豆包APP联动,实现车机与移动端的无缝衔接。
更值得关注的是,豆包座舱助手已与上汽集团达成合作,首款搭载该助手的车型荣威家越已确定落地。这意味着大模型不再是"云端Demo",而是真正进入了汽车量产供应链。
影响与意义:
- 场景突破: 智能座舱是AI大模型落地最具商业价值的场景之一,火山引擎此举抢占了车企智能化的关键入口。
- 生态闭环: 车机+手机APP的联动,构建了"出行-生活"的完整数据闭环,用户粘性远超单一APP。
- 行业示范: 与上汽的合作将为其他车企提供可复制的智能化升级路径,推动大模型在汽车行业的规模化落地。
二、DeepSeek大幅下调Flash系列API价格,闲时输入降60%
发布方: DeepSeek
核心亮点:
9月10日12时起,DeepSeek正式下调Flash系列模型的API价格。其中,闲时输入(缓存命中)价格由0.05元/百万Token降至0.02元/百万Token,降幅高达60%。这一调价并非孤立事件,而是国产大模型从"卖能力"走向"卖服务"的阶段性必然。
DeepSeek此前已建立峰谷计费机制:工作日高峰时段(9:00-12:00、14:00-18:00)执行标准价,其余时间为闲时价;周末则全天执行闲时价。此次降价进一步拉低了闲时使用成本,对夜间和周末批量处理任务的用户极具吸引力。
| 计费项 | 调价前 | 调价后 | 降幅 |
|---|---|---|---|
| 闲时输入(缓存命中) | 0.05元/百万Token | 0.02元/百万Token | 60% |
影响与意义:
- 成本重构: 对于高频调用、缓存命中率高的企业客户,实际API成本将显著下降,加速大模型在中长尾场景的渗透。
- 价格锚点下移: DeepSeek作为"价格杀手"的持续降价,将继续对整个行业的定价体系施加压力。
- 商业模式转型: 低价策略背后,是从单纯API售卖向"平台+服务"的综合价值交付转变。
三、国产大模型价格梯队分化,"经济型"与"旗舰型"差距拉大
发布方: 智谱AI、阿里通义、月之暗面等
核心亮点:
截至2026年9月,国产大模型API价格已呈现明显的"梯队分化"格局。经济型模型的输入价格普遍降至1元/百万Token以下,部分甚至逼近"免费"边缘;而旗舰级模型仍维持数十元至上百元不等的定价。
以智谱AI为例,8月26日开源的GLM-5.3-Flash定价仅为旗舰版的十分之一,输入价格低至约0.15美元/百万Token(约合人民币1元)。阿里同日开源的Qwen3.8-Flash,官方称价格最低可至DeepSeek V4 Flash的三分之一。
| 模型 | 提供商 | 输入价格(元/百万Token) | 输出价格(元/百万Token) | 定位 |
|---|---|---|---|---|
| GLM-5.3-Flash | 智谱AI | ~1.0 | ~3.5 | 经济型 |
| Qwen3.8-Flash | 阿里巴巴 | ~0.6 | ~2.1 | 经济型 |
| DeepSeek V4 Flash | DeepSeek | ~0.4(闲时更低) | ~2.0 | 经济型 |
| Kimi K2.7 Code | 月之暗面 | 6.5 | 27 | 编程专用 |
| Kimi K3 | 月之暗面 | 20 | 100 | 旗舰型 |
| GLM-5.3 | 智谱AI | ~15 | ~50 | 旗舰型 |
注:部分价格为美元换算,汇率按7.1估算,具体以官网为准。
影响与意义:
- 市场分层明确: 经济型模型满足日常问答、内容生成等基础需求,旗舰型模型服务复杂推理、代码生成等高价值场景,市场分工趋于清晰。
- 开源策略见效: 智谱、阿里等通过开源Flash版本扩大生态覆盖,以"低价走量"策略争夺开发者社区。
- 利润空间压缩: 经济型模型的极端低价意味着仅靠API调用难以盈利,厂商必须通过增值服务、企业定制和云资源捆绑来实现商业闭环。
四、智谱GLM-5.3系列生态扩展,编程与安全能力双提升
发布方: 智谱AI
核心亮点:
智谱AI的GLM-5.3系列在9月持续扩展生态。作为智谱迄今编程能力最强的模型,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%;在网络安全领域,其在白盒代码审查与漏洞发现等任务中表现持平国际顶尖模型Mythos 5。
GLM-5.3目前已在智谱官方平台z.ai上线,同时通过第三方平台如千问AI平台等渠道分发。其开源版本GLM-5.3-Flash以极低价格切入市场,为开发者和中小企业提供了高性价比的选择。
影响与意义:
- 技术实力获认可: GLM-5.3在全球大模型能力榜上排名第7,是排名最高的国产模型,与国际顶尖水平的差距缩小至8分以内。
- 双轮驱动策略: "开源低价Flash版抢生态 + 闭源旗舰版赚利润"的策略,正在成为国产大模型厂商的标准打法。
- 安全能力突围: 在代码安全这一高门槛领域达到国际一线水平,意味着国产模型在关键基础设施领域的可信赖度显著提升。
五、阿里通义千问Qwen3.8-Max升级,长周期自主开发能力增强
发布方: 阿里云
核心亮点:
9月2日,阿里云上线Qwen3.8-Max-0902版本,在保持百万Token上下文和原生多模态能力的基础上,重点强化了工程级编程、长程自动开发、多工具协作以及端到端智能体任务能力。官方披露的多个编程基准测试中,DeepSWE 1.1分数从56.6大幅提升至69,进步显著。
Qwen3.8-Max的升级方向明确指向"Agent时代":不再满足于单次问答的准确性,而是追求在复杂、长链路任务中的自主规划与执行能力。这与阿里在 enterprise 市场的战略布局高度一致。
影响与意义:
- Agent能力竞赛: Qwen3.8-Max的升级表明,国产大模型的竞争焦点已从"单轮对话质量"转向"多步任务执行",Agent化是共同方向。
- 企业市场深耕: 长周期自主开发能力的增强,使Qwen3.8-Max更适合软件工程、数据分析等企业级复杂场景。
- 生态协同效应: 阿里云拥有国内最完整的云服务体系,Qwen与云产品的深度整合将形成难以复制的生态壁垒。
趋势总结与展望
从9月17日的国内大模型动态中,可以观察到三个关键趋势:
-
场景落地优先于参数竞赛: 火山引擎的座舱助手、阿里的Agent能力升级,都表明国内厂商已经将重心从"模型多大"转向"模型能用在哪里"。智能汽车、企业编程、网络安全等垂直场景正成为大模型商业化的主战场。
-
价格战进入"结构化"阶段: 简单的全线降价已被经济型/旗舰型的分层定价所取代。厂商通过开源Flash版本覆盖中长尾用户,同时以旗舰版维持利润,形成更可持续的商业结构。
-
生态整合决定长期胜负: 无论是字节的车机-手机联动、阿里的云+模型一体化,还是智谱的开源社区建设,都说明孤立的大模型产品难以持续,必须嵌入更大的产品生态才能产生网络效应。
展望未来,随着国产大模型能力的持续提升和价格体系的进一步透明化,中国AI市场的竞争将进入"应用为王"的新阶段。谁能将大模型更深、更稳地嵌入实体产业的生产流程,谁就能在这一轮智能化浪潮中占据制高点。
数据来源
本文信息综合自以下渠道: - 火山引擎官方产品发布(2026-09-17) - DeepSeek 官方API定价公告(2026-09-10) - 智谱AI z.ai 平台及千问AI平台模型信息 - 阿里云Qwen3.8-Max发布说明(2026-09-02) - 中国经济网、第一财经等媒体报道 - 腾讯云TokenHub、讯飞星辰MaaS等平台价格数据 - lmmarketcap、tokencost.app 等第三方价格监测网站
注:价格数据截至2026年9月中旬,各厂商定价可能随时调整,请以官方最新公告为准。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论