总览
2026年8月25日,国产大模型市场延续着技术迭代与价格重塑的双重节奏。阿里通义千问 Qwen3.5 Flash 系列正式开放 API 服务,以混合架构实现推理性能与成本的最优平衡;月之暗面 Kimi 第一代万亿参数模型 K2.5 即将完成历史使命,K3 接棒前行;智谱 AI 发布 GLM-5.3,编程能力较上代提升 50%;DeepSeek 于 8 月 23 日起优化峰谷计费规则,周末全天执行低谷价;MiniMax 第三代视频模型 H3 开源,登顶视频编辑能力全球第一。以下是本期精选的五大国内大模型动态。
一、阿里通义千问 Qwen3.5 Flash 系列正式开放 API
发布方/来源:阿里云 / 通义千问官方
核心亮点:
- 正式上线:阿里通义千问 Qwen3.5 Flash 系列模型于 8 月完成 API 正式上线,面向企业和开发者全面开放。
- 混合架构设计:Qwen3.5 Flash 采用混合架构,通过架构层面的深度优化,有效提升整体推理吞吐,压缩接口响应耗时,兼顾推理性能与调用成本。
- 多模态能力增强:同步提升多模态图文解析能力,App 端模型广场迭代行业 Agent 导入相关功能,进一步降低企业 AI 落地的技术门槛。
- Token Plan 接入:8 月 25 日,千问 APP 与 PC 端上线阿里云 Token Plan 接入功能,用户绑定 API Key 后,"工作助理"执行复杂任务可直接使用订阅额度。
影响与意义:
Qwen3.5 Flash 的 API 开放,是阿里在大模型商业化路径上的重要一步。与追求极致性能的 Qwen3-Max(万亿参数,Chatbot Arena 全球第三)不同,Flash 系列主打"高并发、低成本、快响应",这恰好切中了当前企业客户的核心诉求。在国产大模型价格竞争白热化的背景下,阿里的混合架构思路——用架构创新而非单纯堆参数来实现性能优化——为行业提供了有价值的参考路径。
二、月之暗面 Kimi K2.5 即将退役,K3 接棒上位
发布方/来源:月之暗面 Kimi 官方
核心亮点:
- K2.5 下线倒计时:8 月 24 日,月之暗面官方宣布,第一代万亿参数多模态模型 Kimi K2.5 将于 2026年8月31日 正式下线,同期退出的还有 moonshot-v1 系列模型。
- K3 已发布:Kimi K3 作为继任者已于此前正式发布,参数规模达 2.8 万亿,性能对标国际顶级水平。华为昇腾算力平台已迅速完成对 K3 的全面适配。
- 商业化进展迅猛:月之暗面今年 6 月 ARR(年化收入)达到 3 亿美元,K3 发布后实现数倍增长。市场消息显示,公司预计最快 6 个月内有望完成港股上市。
影响与意义:
K2.5 的退役是国产大模型快速迭代的缩影——从发布到下线仅约 7 个月。这种"速生速朽"的背后,是技术迭代的加速,也是市场竞争的残酷。K3 的 2.8 万亿参数规模和开源策略(开发者可自行部署)显示出月之暗面的技术自信。ARR 的快速增长和潜在的港股上市计划,则表明这家成立仅两年的公司正在从"技术先锋"向"商业巨头"转型。
三、智谱 AI 发布 GLM-5.3:编程能力最强开源模型
发布方/来源:智谱 AI 官方
核心亮点:
- 正式发布:8 月 14 日,智谱 AI(2513.HK)发布 GLM-5.3。与 GLM-5.2 相比,基座模型保持不变,但通过极致的后训练 Scaling 大幅提升了模型的智能上界。
- 编程能力飞跃:GLM-5.3 的编程能力较 GLM-5.2 提升 50%(智谱内部 Z.ai Code Bench 数据),在 Terminal Bench 3.0 等公开基准测试中达到全球领先水平。
- 开源策略延续:智谱继续坚持开源路线,GLM-5.3 的发布进一步巩固了其在开源大模型领域的领先地位。
- 市场认可:GLM-5.3-max 首次入榜 Chatbot Arena 即杀入前十,ELO 评分达 1531 分。
影响与意义:
GLM-5.3 的发布证明了"后训练 Scaling"的价值——在不增加基座模型参数的前提下,通过更精细的后训练流程实现能力跃升。这对于算力资源有限的团队具有重要启示。智谱的港股上市(2513.HK)为其提供了充足的资本支持,而 OpenClaw 应用的爆发式增长则验证了 GLM 系列在 C 端市场的吸引力。值得关注的是,智谱近期还被社区发现可能以"Ox Alpha"代号在 OpenRouter 低调测试新模型,表现接近 Claude Opus 4.8。
四、DeepSeek 优化峰谷计费:周末全天低谷价
发布方/来源:DeepSeek API 开放平台
核心亮点:
- 8月23日起生效:DeepSeek API 开放平台宣布优化峰谷计费规则,周六、周日全天不再区分峰谷时段,统一按低谷时段价格计费。
- 工作日峰谷规则保留:工作日(周一至周五)高峰时段为北京时间 9:00-12:00 和 14:00-18:00,其余时间为低谷。低谷价格为高峰价格的一半。
- 旗舰模型定价:以 DeepSeek-V4-Pro 为例,高峰时段每百万 token 输入(缓存未命中)9 元、输出 27 元;低谷时段输入 4.5 元、输出 13.5 元。缓存命中输入低至 0.3 元。
影响与意义:
这并非 DeepSeek 的第一次价格创新。2026 年 5 月,DeepSeek 已将 V4-Pro 永久降价 75%,引发全球大模型定价体系的历史性重构。此次峰谷调价的本质,是通过价格杠杆平滑算力需求曲线,提高服务器资源利用率。对于开发者而言,周末全天低谷价意味着更灵活的调用节奏和更可预测的成本。在国际研究机构 Artificial Analysis 的数据中,DeepSeek-V4-Flash 的平均测试成本仅为 0.03 美元,而同档位 OpenAI GPT-5.6 Sol 为 1.86 美元——相差数十倍。即使完成涨价,DeepSeek 的性价比优势依然显著。
五、MiniMax H3 开源:视频编辑能力全球第一
发布方/来源:MiniMax / 稀宇科技
核心亮点:
- H3 模型开源:8 月初,MiniMax 正式发布并开源第三代视频模型 H3(海螺 H3),支持 2K 分辨率及 15 秒音画生成。
- 视频编辑能力登顶:在视频编辑能力的权威评测中,H3 位列全球第一。模型采用 H3-Context-IR 架构实现多模态统一理解,可精准遵循复杂指令。
- Design 工具发布:MiniMax 同步推出 AI 创作工具 Design,由 H3 模型驱动,覆盖从原始素材处理、内容生成、精细编辑到最终成果交付的全链路。
- 资本市场认可:发布次日,MiniMax-W(HK0100)股价接连冲高,累涨超 11%,同时获纳入港股通标的。
影响与意义:
MiniMax H3 的开源是国产多模态大模型的重要里程碑。与文本大模型的"价格战"不同,视频生成模型仍处于"技术竞赛"阶段——谁能生成更高质量、更可控、更长时间的视频,谁就能定义下一代内容生产工具。H3 在视频编辑能力上的全球第一,证明了国产模型在特定垂直领域的竞争力。随着 Seedance 2.5 等竞品同步发力 30 秒长片生成,AI 视频赛道正在进入"长时长、高分辨率、强可控"的新阶段。
国内大模型价格对比表
| 厂商/模型 | 输入价格(百万token) | 输出价格(百万token) | 备注 |
|---|---|---|---|
| DeepSeek-V4-Pro(高峰) | 9元 | 27元 | 缓存命中输入0.3元 |
| DeepSeek-V4-Pro(低谷) | 4.5元 | 13.5元 | 周末全天低谷价 |
| DeepSeek-V4-Flash | ~0.3元 | ~0.6元 | 缓存命中低至0.02元 |
| 文心一言企业版(调价后) | 大幅下调 | 大幅下调 | 整体降价85% |
| 阿里 Qwen3.5 Flash | 未公开 | 未公开 | 混合架构优化成本 |
| OpenAI GPT-5.6 Luna(参考) | ~1.4元 | ~4.2元 | 7月降价80%后 |
注:以上价格为人民币换算估算,实际价格以各平台官方定价为准。数据截至 2026年8月25日。
趋势总结与展望
2026年8月的国内大模型市场呈现出三大趋势:
-
开源与商业并行的双轨战略:月之暗面 K3 开源、智谱 GLM-5.3 开源、MiniMax H3 开源——国产头部厂商正在通过开源建立技术标准,再通过云服务和企业版实现商业变现。这种模式既扩大了开发者生态,又保护了核心收入来源。
-
价格创新成为核心竞争力:DeepSeek 的峰谷计费、文心一言的 85% 降幅、阿里 Token Plan 的灵活订阅——国产大模型在定价创新上比国际对手更激进。这背后是中国算力成本的相对优势,也是厂商对市场份额的激烈争夺。
-
多模态成为新增长点:当文本大模型的性能差距逐渐缩小,视频、图像、音频等多模态能力成为差异化竞争的焦点。MiniMax H3 的视频编辑能力、阿里 Qwen3.5 的图文解析能力,都表明国产模型正在多模态赛道上加速追赶。
展望未来三个月,我们需要关注:月之暗面的港股上市进展、DeepSeek 是否会进一步调整定价策略、以及国产模型在国际权威榜单(如 Chatbot Arena)上的排名变化。国产大模型的竞争,正在从"追平国际水平"转向"定义本土标准"。
数据来源:阿里云帮助中心、月之暗面官方微博、智谱 AI 开放文档、DeepSeek API 开放平台公告、36氪、IT之家、财联社、CSDN 等。数据截至 2026年8月25日。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论