9月10日,DeepSeek正式发布V4.1 Flash。这款552B参数的MoE模型采用了全新的非对称Causal Encoder-Decoder架构,成为DeepSeek新架构系列中尺寸最小的成员,性能却超越了包括V4 Pro在内的一众旗舰。

架构亮点

  • 552B总参数:输入时激活约8B,输出时激活约16B
  • 非对称架构:Causal Encoder-Decoder,输入输出激活不同
  • 196B Engram记忆表:独立的记忆参数表
  • 原生多模态:支持视觉理解
  • 1M上下文:超长上下文窗口

缓存优化

最引人注目的优化是长文本缓存硬盘占用降低88%。这意味着:

  • 部署成本大幅下降
  • 长文本处理速度提升
  • 企业级部署门槛降低

Agent能力

Terminal Bench 2.1从Preview版的61.8提升到82.7,DeepSWE从7.3飙升到54.4。Agentic能力的质变让DeepSeek V4.1 Flash成为开发Agent应用的首选模型之一。

开源协议

MIT协议开放权重,已上线Hugging Face。这对开发者社区是重大利好。