DeepSeek V4.1-Flash:非对称架构重夺国产性价比榜首

DeepSeek V4.1-Flash:非对称架构重夺国产性价比榜首

Author: tengdy | Create: 2026-09-14 09:49:55 | Update: 2026-09-14 09:49:55 | 分类:大模型

V4.1-Flash国产模型MoEDeepSeek性价比

事件内容

9 月 10 日,DeepSeek 正式发布 V4.1-Flash,并同步上线 API。该模型采用全新的 Causal-Encoder-Decoder 非对称架构,主干约 552B 参数的 MoE,输入侧仅激活 8B 参数,生成侧激活 16B 参数,原生支持多模态视觉理解。

关键数据:

  • KV Cache 压缩:对 HBM 的需求降至前代的约 1/4,对 SSD 的需求降至约 1/8。
  • 评测:第三方测试在 Terminal-Bench 2.1 中得分 90.6,宣称超越自家旗舰 V4-Pro。
  • 定价:缓存命中输入单价较此前下降约 60%,闲时缓存命中低至 0.02 元 / 百万 tokens;输出价格 4 元 / 百万 tokens。
  • 路由切换:自 9 月 14 日 12:00 起,deepseek-v4-pro 的请求将全部路由至 V4.1-Flash,并按 Flash 单价计费。

为什么值得关注

V4.1-Flash 把国产模型的“能力—成本”帕累托边界又往外推了一步。对于 Agent、长文档问答、RAG 这类高输入、长上下文的任务,低成本高质量的基座模型意味着更大规模的场景落地成为可能。

参考来源:搜狐 AI 应用周度观察新浪财经研报

评论(0)

暂无评论,来抢沙发~


关于本站 · RSS

浙ICP备2025156991号浙公网安备33010802013816号 浙公网安备33010802013816号 © 2026 智能体工场 - [从善如登] All rights reserved.