李飞飞发布Atlas:几张照片补出3D世界,虚拟镜头想怎么飞就怎么飞
发布时间:2026-09-02
动察 Beating AI 快讯,李飞飞创办的 World Labs 发布 Atlas,官方称这是全球首个能精确控制镜头生成图像和视频,同时完成 3D 重建的多模态世界模型。最直观的玩法有点像全景无人机,但 Atlas 不需要真的把四周都拍下来。给它一到几张照片,再画一条镜头路线,它就能自己补出没拍到的墙后、物体背面和周围空间,让虚拟镜头沿着指定路线飞过去。最高能生成 1 分钟、1440p 视频。普通视频模型主要根据文字或图片继续生成像素,镜头运动也通常靠「左移」「推进」这类文字描述。Atlas 会直接读取相机在 3D 空间里的位置和角度,还能生成深度和完整 3D 场景。输入照片越多,它需要自己脑补的地方就越少。这也是 World Labs 把它叫「世界模型」的原因。它不只是在猜下一帧长什么样,还要知道相机在哪里、物体在哪里、换个角度应该看到什么。World Labs 还用它把真实空间变成机器人训练用的仿真环境。Atlas 目前只向部分合作伙伴开放。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,李飞飞创办的 World Labs 发布 Atlas,官方称这是全球首个能精确控制镜头生成图像和视频,同时完成 3D 重建的多模态世界模型。


最直观的玩法有点像全景无人机,但 Atlas 不需要真的把四周都拍下来。给它一到几张照片,再画一条镜头路线,它就能自己补出没拍到的墙后、物体背面和周围空间,让虚拟镜头沿着指定路线飞过去。最高能生成 1 分钟、1440p 视频。


普通视频模型主要根据文字或图片继续生成像素,镜头运动也通常靠「左移」「推进」这类文字描述。Atlas 会直接读取相机在 3D 空间里的位置和角度,还能生成深度和完整 3D 场景。输入照片越多,它需要自己脑补的地方就越少。


这也是 World Labs 把它叫「世界模型」的原因。它不只是在猜下一帧长什么样,还要知道相机在哪里、物体在哪里、换个角度应该看到什么。World Labs 还用它把真实空间变成机器人训练用的仿真环境。Atlas 目前只向部分合作伙伴开放。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang