Atlas(World Labs)
李飞飞团队推出的多模态世界模型,能将文本、图片、视频和 3D 输入转换为具有精确相机控制的高清视频。支持长达 1 分钟 1440p 视频生成、空间重建和真实场景 3D 化。
目标受众
视频创作者、游戏开发者、VFX 设计师、建筑师和需要高质量空间内容生成的创意专业人士。
使用场景
- 影视前期预览:从参考图和镜头脚本生成连贯的预演视频,精确控制每个镜头运动
- 游戏场景制作:将概念图转化为可漫游的 3D 环境,加速美术资产生产
- 建筑可视化:从设计图生成带镜头运动的建筑漫游视频
- 广告创意制作:快速生成不同版本的产品视频广告,降低试错成本
- 真实场景数字孪生:从实拍视频重建 3D 空间,用于 VR/AR 和虚拟制作
设计初衷
让 AI 真正理解三维空间,而不只是生成像素级的视频帧。Atlas 的核心是"世界模型"——它把所有输入(文本/图像/视频/3D)映射到一个共享的空间上下文中,生成的不是随机画面,而是一个几何一致、可以从任意视角查看的虚拟世界。
解决什么问题
解决了当前视频生成模型"相机不受控、内容不一致、3D 感弱"的核心痛点。传统文生视频模型只能给你一段视频,Atlas 让你像导演一样设计镜头轨迹、控制视角、保持空间一致性,并能输出真正可用的 3D 资产。
评分理由
技术突破级产品,李飞飞背书的 World Labs 团队背景扎实,世界模型是 AI 视频下一阶段的核心方向。相机精确控制和 3D 输出是显著差异化。但目前还是技术展示阶段,产品化程度和可用性还需观察,且面向专业创作者市场,C 端渗透路径不明确。
对标竞品
Sora 是文生视频标杆,视频质量和时长领先,但相机控制和空间一致性较弱;Atlas 强调世界模型范式,相机精确可控且能输出 3D。
Runway 是成熟的 AI 视频创作平台,有完整的编辑器和工作流;Atlas 更侧重底层世界模型能力,在空间一致性和 3D 输出上更具技术优势。
Luma 专注 3D 重建和 NeRF 视频生成,产品化程度高;Atlas 的世界模型更通用(支持文生/图生/重建多种模式),且视频分辨率和时长更有优势。