01
生成
沿指定相机位置与轨迹创建新帧和视频。
Atlas 把图片和深度图锚定到相机位置,再凭借这份空间上下文生成新视角、重建几何,并仿真在场景中的运动。
01
沿指定相机位置与轨迹创建新帧和视频。
02
把稀疏图片或视频帧转为新视角与显式 3D 表示。
03
对空间与时间建模,用于重构图的 VFX 镜头与 Real-to-Sim 机器人工作流。
核心能力
发布材料覆盖创意制作与物理仿真。这些是 World Labs 的演示与主张,不是独立的 Topview 基准。
Atlas 把相机几何当作原生输入,而不只依赖 pan、crane、orbit 这类文字。World Labs 展示了在连贯生成场景中手绘相机路径。
演示:最高 1 分钟、1440p
从一张或多张图片出发,生成未见视角、估计几何;当忠实重建真实世界比合理想象更重要时,再补充更多视角。
从稀疏视角到显式 3D
用少量普通相机重建运动,从新角度重构图事件,或生成仿真机器人会看到的 RGB 与深度观测。
VFX、导航与操作
世界建模是主线,但 World Labs 也演示了遵循提示词的图片生成、文字渲染、多种视觉风格,以及由文本或图片提示词得到的 360 度图片。
每一帧都是进入被建模世界的一个视角
模型如何工作
Atlas 按元素处理多模态序列,图片与深度输入都绑定到显式相机位姿。
实际思路很简单:每多一个真实视角,模型对场景就多一份了解。观察到的越少,Atlas 越需要想象;观察到的越多,重建就越能依靠证据。
按任务提供文本、一张或多张图片、图片序列、相机位姿或深度信息。
把每一帧放到已知相机位置,让模型把外观与空间对应起来。
自回归预测与扩散会基于已有上下文,产出新的多模态元素。
返回新视角、可控视频、深度、点云,或可供下游使用的 Gaussian Splat 场景。
Atlas 可能适用的场景
Atlas 被定位为需要超越单帧好看画面的场景基础。它的价值在于外观、几何、视点与随时间变化之间的连接。
设计精确相机路径,围绕表演生成新视角,并用重建的深度或 3D 结构支持重构图与合成。
把参考当作空间锚点来排布,探索想法之间的过渡,并测试相机如何穿过拟定环境。
生成可探索的场景表示与多个一致视点,为环境概念、布局与原型提供依据。
重建真实环境、改变条件,并生成仿真传感器视角,用于导航或操作的训练与评估。
用同一套世界感知上下文处理风格化图片、360 度场景,以及更长的相机控制序列。
Atlas 与 Marble
Atlas 与 Marble 相关,但不是可互换的名字。决定今天能用什么时,这个区分很重要。
面向生成、重建与仿真的下一代全模态世界模型,覆盖创意与机器人任务。
目前可在 Topview Canvas 中生成并探索 3D 世界的在线模型系列。
仅向部分 World Labs 合作方提供早期访问;公开定价与普遍访问尚未宣布。
Marble 1.1 与 Marble 1.1 Plus 可在 Topview 的 3D World 工作流中选择。
World Labs 描述的共享上下文覆盖文本、图片、相机位姿、深度,以及以图片序列表示的视频。
Topview 接受一条文本提示词,外加一张图片或一段短视频参考;图片与视频参考互斥。
已演示的输出包括帧、视频、深度、点云与 3D Gaussian splat。
Topview 返回可探索的 Gaussian Splat 世界卡片,创作者可将视角截回 Canvas。
World Labs 表示 Atlas 将驱动未来版本的 Marble 及其他 World Labs 产品。
当前 Topview 集成仍绑定 Marble 1.1 与 Marble 1.1 Plus,而不是 Atlas。
Topview 是独立产品,不是 World Labs 官网。可用性可能变化,规划生产依赖前请核实现网模型选择器与 World Labs 官方渠道。
技术细节
浓缩 World Labs 已公开的内容,不补写未公布的模型规模、定价或 API 参数。
常见问题
关于模型、输入输出、Atlas 访问,以及 Topview 当前支持范围的直接回答。
用今天已上线的能力创作
Atlas 仍处于精选合作方早期访问。若要立刻使用现网创作工作流,可用 Marble 1.1 或 Marble 1.1 Plus 生成可探索世界,再把视点截回 Canvas。
Topview 目标页使用当前 Marble 模型,并不意味着可访问 Atlas,也不表示与 World Labs 存在从属关系。