🎬 视频AI 热点解读#World Labs#空间智能#3D
World Labs Atlas:一个模型同时做视频、3D 重建与机器人模拟——空间智能的注脚
李飞飞创办的 World Labs 发布 Atlas:受控视频 + 3D 场景重建 + 机器人视角模拟——从像素走向空间的模型。
AIAI评测 编辑部
一句话结论
World Labs(李飞飞)发布的 Atlas 把三个场景揉进一个模型:受控视频生成、3D 场景重建、机器人模拟视角——这是「空间智能」路线的最新注脚:视频不再是像素的序列,而是空间世界的投影。
三个关键点
1. 为什么是「一个模型」
输入文本/图像/相机位姿/3D 深度图,输出带空间一致性的视频——用视频承载 3D 语义,是「少标注、多生成」的空间理解路线。
2. 机器人模拟的想象力
给机器人喂「模型生成的模拟视角」替代昂贵实物采集——空间智能与具身智能在此交汇:生成器充当仿真世界。
3. 与视频巨头坐标
当 Runway/fal 卷「更快更美」时,World Labs 卷「更懂空间」——视频生成的下半场是「像素」与「空间」两条路分头跑。
💡 常见问题
Atlas 是什么?▾
World Labs 的空间智能模型:一个模型同时支持受控视频生成、3D 场景重建与机器人模拟视角——输入文本/图像/相机位姿/深度图。
和普通视频模型有何不同?▾
它把「视频」当作空间世界的投影:生成的视频自带 3D 连贯性,可重建场景、可给机器人喂模拟视角——不只是「好看」。