科大讯飞开源星火X2.5端侧大模型,原生支持百万Token上下文

端侧AI新突破

2026年9月1日,科大讯飞子公司词元星火推出并开源星火X2.5-4B1.7B两款端侧通用大模型,原生支持最长100万Token上下文,基于全国产算力训练。

核心特性

  1. 超长上下文:原生支持100万Token,可在本地处理超长文档、代码库和日志
  2. 端侧部署:4B和1.7B两种参数规格,适配不同硬件条件
  3. 国产算力:基于全国产芯片训练和推理
  4. 免费API:相关API已在讯飞星辰MaaS平台限时免费上线

应用场景

端侧大模型特别适合以下场景:

  • 隐私敏感:医疗、金融等场景数据不出本地
  • 离线使用:无网络环境下的智能辅助
  • 实时响应:本地推理避免云端延迟
  • 成本控制:减少云端API调用费用

技术路线

讯飞选择"端侧+云端"协同的技术路线:

  • 端侧处理敏感、低延迟需求
  • 云端处理复杂、高算力需求

这种架构既保护了用户隐私,又保证了服务能力。

开源生态

作为开源模型,星火X2.5-4B/1.7B允许开发者:

  • 自由部署到本地设备
  • 二次开发和定制
  • 参与社区共建

这将进一步丰富国产端侧AI生态。

本文基于公开信息整理创作



本文源自「腾讯新闻