今
🎯 科技 · AI应用
🔥 李飞飞发布全球首个多模态世界模型Atlas,AI从"生成画面"迈向"理解世界"
一、科幻照进现实:Atlas让AI"看见"三维世界
9月2日,"AI教母"李飞飞旗下创企Wo... 展开 ▼
🎯 科技 · AI应用
🔥 李飞飞发布全球首个多模态世界模型Atlas,AI从"生成画面"迈向"理解世界"
一、科幻照进现实:Atlas让AI"看见"三维世界
9月2日,"AI教母"李飞飞旗下创企World Labs正式发布全球首个多模态世界模型Atlas。这不是又一个图片生成工具——Atlas的核心突破在于让AI真正理解三维世界的物理法则和几何结构,而不仅仅是生成看起来合理的二维画面。
传统大模型处理文本上下文,Atlas则用"空间上下文"(Spatial Context)取而代之。它将文字、图像、深度图和相机位姿全部揉进同一个三维坐标系中,相当于给AI提供了一张带有"坐标轴"和"比例尺"的三维草稿本。
二、子弹时间触手可及,2张照片重建整个广场
Atlas展现的能力令人印象深刻:只需1到6张普通照片,就能生成最长1分钟、分辨率1440p的视频,且用户可以精确控制相机运动轨迹。更夸张的是,在DTU公开数据集测试中,Atlas仅凭2到25张地面拍摄的照片,就重建了斯坦福大学整个主方庭,并生成高空俯瞰的飞行路径,重建误差仅25.3‰,优于多个专用3D重建模型。
这意味着什么?过去拍摄《黑客帝国》式"子弹时间"需要60台相机阵列,现在3到5台手机就够了。#李飞飞发布多模态世界模型Atlas# 的瞬间,视觉特效和内容创作领域的门槛被大幅拉低。
三、终极目标:打通具身智能的"数据荒"
Atlas最深远的应用不在影视特效,而在机器人预训练。当前机器人训练面临的最大瓶颈是真实世界数据匮乏——让机器人在现实中试错成本太高。Atlas可以通过少量真实照片生成逼真的三维模拟环境,让机器人在仿真世界中完成海量训练,再迁移到现实。
World Labs称这是团队的一个"里程碑式"成果。从视觉特效到机器人,从内容创作到自动驾驶,一个能"用三维视角理解世界"的AI,正在把科幻变成基建。
综合科创板日报、爱范儿、i黑马报道 | 2026-09-03
收起 ▲