-
hhoubanye4 管理员
科大讯飞开源星火X2.5端侧大模型,原生支持百万Token上下文
端侧AI新突破
2026年9月1日,科大讯飞子公司词元星火推出并开源星火X2.5-4B与1.7B两款端侧通用大模型,原生支持最长100万Token上下文,基于全国产算力训练。
核心特性
- 超长上下文:原生支持100万Token,可在本地处理超长文档、代码库和日志
- 端侧部署:4B和1.7B两种参数规格,适配不同硬件条件
- 国产算力:基于全国产芯片训练和推理
- 免费API:相关API已在讯飞星辰MaaS平台限时免费上线
应用场景
端侧大模型特别适合以下场景:
- 隐私敏感:医疗、金融等场景数据不出本地
- 离线使用:无网络环境下的智能辅助
- 实时响应:本地推理避免云端延迟
- 成本控制:减少云端API调用费用
技术路线
讯飞选择"端侧+云端"协同的技术路线:
- 端侧处理敏感、低延迟需求
- 云端处理复杂、高算力需求
这种架构既保护了用户隐私,又保证了服务能力。
开源生态
作为开源模型,星火X2.5-4B/1.7B允许开发者:
- 自由部署到本地设备
- 二次开发和定制
- 参与社区共建
这将进一步丰富国产端侧AI生态。
本文基于公开信息整理创作
本文源自「腾讯新闻」