-
aaideit_admin 管理员
DeepSeek发布V3.2-Exp模型,稀疏注意力机制降本50%
2025年9月29日,DeepSeek正式发布实验性大模型V3.2-Exp,引入创新的稀疏注意力机制,API成本直接腰斩。
技术突破
稀疏注意力机制(DSA):DeepSeek首创的Sparse Attention机制,通过动态筛选关键token,大幅提升长文本处理效率。
效率提升:
- 长文本推理速度提升2-3倍
- 内存占用降低30%-40%
- API成本降低50%以上
性能表现
- 在数学推理(AIME 2025)和编程竞赛(Codeforces)中逆势提升
- Agent工具调用能力在BrowseComp-zh测试中获47.9分
- 保持V3.1-Terminus的性能水平
开源与部署
模型已在Hugging Face开源,并完成以下适配:
- 华为昇腾芯片
- 寒武纪芯片
- PPIO派欧云、优刻得等云平台
API定价:输入缓存命中场景低至\(0.07/百万token,未命中场景\)0.56/百万token。
本文源自「DeepSeek官方博客」