新模型
2026-09-02
🔥 重点
李飞飞 World Labs 发布 Atlas 世界模型:几张照片生成 1 分钟 3D 视频
来源:腾讯新闻
李飞飞 World Labs 发布 Atlas 世界模型:几张照片生成 1 分钟 3D 视频
一句话说清:「AI 教母」李飞飞的公司发了个新 AI——Atlas,丢几张普通照片进去,它就能「脑补」出一个能转视角、能导出 3D 模型的虚拟世界,最长生成 1 分钟高清视频。
发生了什么
2026 年 9 月 1 日(美东),斯坦福教授 李飞飞 创办的 World Labs 发布多模态世界模型 Atlas,官方称其为「全球首个多模态世界模型(Omni World Model)」:
- 输入很轻:给 1–6 张普通照片(或几十张地面照),再指定运镜轨迹,就能生成最长 1 分钟、1440p 分辨率的视频,镜头角度精确到像素级。
- 能重建 3D:从稀疏照片还原真实场景,输出点云、3D 高斯(Gaussian Splat)、网格(mesh),可直接进 Unity / Unreal 等引擎。
- 时空模拟:能对输入视频同时建模「空间 + 时间」,支持重新构图,以及给机器人做「真实到仿真(Real-to-Sim)」训练数据。
- 架构:多模态自回归扩散 Transformer,把文本、图像、视频、相机位姿、深度图全部锚定到三维「空间上下文」里。
- 当前状态:早期访问(Early Access),仅向部分合作伙伴开放。
来源:World Labs 发布,腾讯新闻、第一财经、网易/金融界等报道(2026-09-02~03)。
对我有什么用
- AI 从「生成好看的 2D 画面」跨向「建一个几何连贯、可漫游、可仿真的 3D 空间」——这是「空间智能」的关键一步。
- 对 影视/特效、游戏、建筑、机器人 都是底层生产力:以前要扛专业设备拍几百张照片做 3D,现在几张手机照就能搭场景。
- 给机器人提供低成本训练数据,具身智能(能干活的人形机器人)落地会更快、更便宜。
我可以怎么做
- 内容创作者 / 影视爱好者:将来用几张照片就能快速「还原一个空间、换镜头」,做分镜、概念片门槛大降。
- 关注落地节奏:Atlas 现在只是早期访问,先收藏、等公开版,别现在就去搜「下载」。
- 把它当信号:世界模型会是继大模型之后的下一波热点,相关工具(3D、视频、游戏)值得持续关注。
温馨提醒
- 还没公开:目前仅合作伙伴可用,普通用户暂时用不上,警惕任何「破解版」骗局。
- 不是物理引擎:擅长几何连贯的静态/弱动态空间,物体碰撞、软体、复杂动力学仍待验证;没拍到的地方靠「脑补」,参考图越少越容易出错。
- 评测主要来自官方/合作方演示,独立基准还没大规模拷打,先别神化。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法