影眸科技发布WorldGen世界生成模型,开启3D场景生成新时代

从单个物体到完整场景

2026年9月1日,3D生成大模型公司影眸科技正式发布WorldGen(世界生成模型),将3D生成从"生成单个资产"推进至"生成完整场景"。用户上传一张场景图片,系统即可自动识别主要物体并生成独立3D资产,同时重构物体之间的物理关系。

技术突破

WorldGen基于影眸自研的CAST架构,该技术于2025年斩获SIGGRAPH最佳论文。核心能力包括:

  1. 自动物体识别:系统自动识别图像中的主要物体
  2. 遮挡补全:补全被遮挡物体的三维结构
  3. 物理关系重建:判断物体间的接触、支撑、悬挂关系
  4. 独立资产生成:每个物体保持语义与几何独立性

生成的3D场景可直接导入NVIDIA Isaac Sim、Unity、Unreal Engine、PlayCanvas等主流平台。

多领域落地

WorldGen已在多个垂直行业展示应用价值:

具身智能:影眸联合地瓜机器人、谋先飞发布"具身智能可训练仿真闭环方案",用真实世界影像直接生成可训练的虚拟场景。

影视制作:WorldGen与Seedance 2.5等视频生成模型形成"3D场景+视频生成"工作流,为多镜头叙事、广告制作、概念短片提供新生产方式。

游戏开发:生成后的独立资产可进入Blender等DCC工具进行材质调整、动画绑定与关卡编辑。

XR应用:用户可进入由单张图片生成的三维空间,从不同位置观察场景,近距离查看物体与环境细节。

技术细节

WorldGen采用混合表达设计:

  • 需要编辑和交互的主要物体:以独立Mesh资产形式生成
  • 不需要参与交互的背景:通过3D高斯保留视觉信息与空间沉浸感

通过Thinking Effort架构,每个资产可按需分配生成精度:关键物体继续修改细化,远处普通物体快速生成,最快4秒即可生成可用的3D资产。

本文基于公开信息整理创作



本文源自「网易智能