
资讯
李飞飞 World Labs 发布 Atlas 多模态世界模型:从单图生成可探索 3D 场景
一句话:World Labs(李飞飞创立)发布 Atlas,一个能从单张图像生成可交互、可探索 3D 世界场景的多模态世界模型,把图像语义升维为可进入的空间。
背景
- 多模态竞争从「文生图 / 文生视频」走向「空间智能」;World Labs 自 2024 起押注「像素→3D 世界」路线,Atlas 是其可产品化的关键一步。
核心要点
- 输入单图,输出带深度与一致性的 3D 场景,可平移 / 旋转 / 缩放探索。
- 结合几何与生成,保证视角切换下的空间连贯。
- 面向创意、游戏预演与数字孪生等场景。
- 标志「空间智能」从研究走向可产品化的世界模型。
为什么重要
- 把图像语义升维为可交互空间,是多模态从「看」到「进」的范式跃迁。
- 为游戏、影视分镜、机器人仿真提供可探索的训练 / 预览环境。
关键事实速记
- 发布:2026-09
- 团队:World Labs(李飞飞)
- 输入:单图
- 输出:可探索 3D 场景
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考