发布日期:2026-09-11 11:53
采用了全新的 Causal-Encoder-Decoder 布局,KV Cache 曾经缩小了 437 倍。同时,为了更合理地调配资本,激励用户按照现实利用环境调整使命时间。闲市价格为高峰时段价钱的一半,对 KV Cache 的压缩大幅降低了 Agent 类使命的利用成本。DeepSeek V4.1 Flash 可以或许以更低的成本办事更多的用户,成本显著低于已知的同尺寸模子。得益于模子架构的立异,新价钱于2026 年 9 月 10 日 12:00起头生效。DeepSeek V4.1 Flash 为 552B 参数的 MoE 模子?
这是我们全新模子布局系列中的最小尺寸的模子,相对于初代模子,如图展现了 DeepSeek 正在削减上下文存储方面的持续进展。具备原生多模态视觉理解能力。因而我们响应下调了 V4.1 Flash 的订价。对 SSD 的需求削减到 1/8。输入和输出不合错误称,正在 Agent 利用场景中,输入激活只要 8B,对 HBM 的需求削减到 1/4,