GLM-5.3-Flash正式发布

8月26日晚,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列的首个原生多模态模型。

架构创新

混合注意力架构

  • 首个采用稀疏注意力与线性注意力混合架构的开源前沿模型
  • 总参数320B,激活参数仅18B
  • 结合30T Token多模态预训练语料
  • 以更低成本提供超越GLM-5.2的智能水平

国产算力支撑

  • 由商汤大装置提供国产算力支持
  • 通过自研高带宽互联网络连接国产芯片集群
  • 端到端服务性能提升3倍
  • 单Token成本已达主流英伟达GPU水平

性能表现

  • 在AA综合智能指数中取得57分,进入全球前沿模型能力区间
  • 与Claude Opus 4.8得分持平
  • 全面超越参数量高一倍的GLM-5.2
  • 定价仅为GLM-5.2的十分之一

多模态能力

视觉能力被原生融入Coding循环,使模型能够主动观察界面、渲染结果与交互反馈,并据此持续测试和改进。可完成从研究分析到PPTX/PDF/DOCX/XLSX成品交付的完整工作流。

来源:科技日报