华为与浙大联合发布DeepSeek-R1-Safe安全大模型

2025年9月18日,华为与浙江大学在华为全联接大会上联合发布国内首个基于昇腾千卡算力平台的安全基础大模型DeepSeek-R1-Safe。

安全突破

防御能力

  • 普通有害问题防御成功率近100%
  • 针对14种有害内容(毒言论、政治敏感、违法行为等)
  • 综合安全防御能力达83%
  • 越狱防御增幅115%

性能保持

  • 通用能力基准测试性能损耗<1%
  • 安全性与可用性完美平衡

技术创新

全流程自主可控后训练框架:

  • 高质量安全语料构建
  • 平衡优化的安全训练
  • 国产软硬件平台适配

开源发布

模型已在ModelZoo、GitCode、GitHub、Gitee、ModelScope等多平台开源,遵循MIT协议。

本文源自「浙江大学官网