编译/VR陀螺 World Labs日前正式发布新一代世界模型Atlas,可基于单张或多张输入图像生成带精准相机控制的图视频,同时完成三维场景重建、时空模拟等复杂任务,标志着空间智能领域从2D生成向3D可控生成的重要升级。 据官方介绍,Atlas是从零开始预训练的多模态自回归扩散变换器,原生支持文本、图像、视频、相机姿态、3D深度图等多种数据类型。所有输入都会被映射到统一的“空间上下文”中,模型在 ...