资讯🔥8.0
李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界
📋总体概括
李飞飞创立的World Labs发布首个多模态空间智能世界模型Atlas,采用从零预训练路线,核心能力是仅凭几张图片就能推断并构建可交互的3D世界。这一成果延续了李飞飞从ImageNet到空间智能的技术主线,与依赖视频生成路线的主流世界模型形成差异化,被视为具身智能获得通用世界先验模型的重要一步。
⚡关键信息
- ▸李飞飞旗下World Labs正式发布首个多模态世界模型Atlas,主打空间智能方向
- ▸Atlas采用从零开始预训练,而非基于现有视频生成模型改造
- ▸核心卖点:仅需几张图片输入,即可构建出完整的三维世界
- ▸与主流依赖大规模视频数据的世界模型路线形成差异化竞争
- ▸该模型瞄准具身智能与机器人领域,为其提供可交互的世界先验
🔥犀利点评
从零预训练是个豪赌:放弃视频生成模型的现成先验,意味着算力和数据成本极高,但换来了真正的3D几何理解而非像素级模仿。几张图重建世界若真能泛化,对机器人仿真训练价值巨大;但 demo 到可用之间隔着泛化鸿沟,李飞飞的招牌光环遮不住商业化验证尚未开始的事实。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文 →