事件内容
9 月 10 日,DeepSeek 正式发布 V4.1-Flash,并同步上线 API。该模型采用全新的 Causal-Encoder-Decoder 非对称架构,主干约 552B 参数的 MoE,输入侧仅激活 8B 参数,生成侧激活 16B 参数,原生支持多模态视觉理解。
关键数据:
- KV Cache 压缩:对 HBM 的需求降至前代的约 1/4,对 SSD 的需求降至约 1/8。
- 评测:第三方测试在 Terminal-Bench 2.1 中得分 90.6,宣称超越自家旗舰 V4-Pro。
- 定价:缓存命中输入单价较此前下降约 60%,闲时缓存命中低至 0.02 元 / 百万 tokens;输出价格 4 元 / 百万 tokens。
- 路由切换:自 9 月 14 日 12:00 起,
deepseek-v4-pro的请求将全部路由至 V4.1-Flash,并按 Flash 单价计费。
为什么值得关注
V4.1-Flash 把国产模型的“能力—成本”帕累托边界又往外推了一步。对于 Agent、长文档问答、RAG 这类高输入、长上下文的任务,低成本高质量的基座模型意味着更大规模的场景落地成为可能。
参考来源:搜狐 AI 应用周度观察、新浪财经研报

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论