每一次AI的代际跃迁,从来都不是参数规模的简单堆砌,而是认知维度的跃迁。从ChatGPT引爆大语言模型浪潮,让机器读懂人类文字;到Sora带火视频生成,让机器创作视觉画面,AI的进化已然超乎人类的想象。然而,无论怎么进化,AI始终在二维信息的边界内打 ...
这是路德维希·维特根斯坦在1921年出版的《逻辑哲学论》中写下的名言。一个世纪后,这句话被AI领军人物之一李飞飞引用,而她创办的World Labs正在让AI理解空间。前段时间,World ...
只用 3 部固定在三脚架上的 iPhone,Atlas 就能重现《黑客帝国》式的“子弹时间”,让镜头绕着凝固的动作移动。 这是 World Labs 最新发布的世界模型 Atlas 展示的能力之一。据 DeepTech ...
当地时间2026年9月1日,“AI教母”李飞飞创办的World Labs发布了新一代世界模型Atlas。官方称其为“全球首个多模态世界模型”,一个可以原生处理文本、图像、视频、相机位姿与3D深度信息,并在同一套模型中完成世界生成、空间重建和时空模拟的全模态世界模型。
举起一部手机,沿着仓库走过,镜头记录下墙面、货架、箱子和通道,World Labs 从这段视频里抽取 24 帧,把原本只存在于画面中的现场放进一个可以继续生成的三维空间。 研究人员随后改变机器人的行走路线。Atlas 根据机身相机新的位置和朝向,生成机器人沿途应该看到的 RGB 图像与深度数据。机器人换了一条路线,视野也随之改变。现实空间被压缩成少量观测,仿真中的传感器又从同一个空间上下文里长出来 ...