DeepSeek发布V3.2-Exp模型,稀疏注意力机制降本50%

2025年9月29日,DeepSeek正式发布实验性大模型V3.2-Exp,引入创新的稀疏注意力机制,API成本直接腰斩。

技术突破

稀疏注意力机制(DSA):DeepSeek首创的Sparse Attention机制,通过动态筛选关键token,大幅提升长文本处理效率。

效率提升

  • 长文本推理速度提升2-3倍
  • 内存占用降低30%-40%
  • API成本降低50%以上

性能表现

  • 在数学推理(AIME 2025)和编程竞赛(Codeforces)中逆势提升
  • Agent工具调用能力在BrowseComp-zh测试中获47.9分
  • 保持V3.1-Terminus的性能水平

开源与部署

模型已在Hugging Face开源,并完成以下适配:

  • 华为昇腾芯片
  • 寒武纪芯片
  • PPIO派欧云、优刻得等云平台

API定价:输入缓存命中场景低至\(0.07/百万token,未命中场景\)0.56/百万token。

本文源自「DeepSeek官方博客