什么是 Atlas?
Atlas 是一种全模态世界模型,可在统一的 3D 空间上下文中处理文字、图像、视频与空间数据。
文字
提示词与指令
图像
参考视图
视频
时序画面
3D 空间
镜头位姿与深度
Atlas 能做什么?
选择一项能力,了解 Atlas 如何生成、重建和模拟空间体验。
基于参考图像生成新视角,并指定镜头位置、角度与运动方式。
最长 1 分钟最高 1440p
镜头可控视频
Atlas 如何工作
Atlas 将视觉输入定位到对应镜头位置,构建统一空间上下文,再基于已有内容生成新的输出。
多模态输入
- 文字与参考图像
- 作为图像序列的视频
- 镜头位姿与深度图
统一空间上下文
每项视觉输入都对应 3D 空间中的具体位置,为镜头控制和场景结构提供一致的空间坐标。
生成结果
- 新视角与长视频
- 点云与 3D 高斯泼溅
- 图像与空间模拟
Atlas 可能带来什么?
了解镜头感知生成与空间重建可能改变的创意和技术工作流程。
从新镜头位置直接设计画面
生成可控镜头运动、重新构图已有素材,并为预演、视觉特效与场景设计探索新视角。
Atlas 更新
为 Atlas 做好准备
加入等待名单。当 Atlas Model Hub 有新的可体验内容时,我们会通过邮件通知你。
