资讯

李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界

InfoQ中文·2026/9/3 16:49:43🔗 原文

📋总体概括

李飞飞团队发布其首个多模态世界模型Atlas,核心亮点为从零开始预训练,而非基于现有大模型微调,且仅需几张图像即可构建出可交互的世界场景。这延续了其从ImageNet到空间智能的技术路线,瞄准让AI理解并生成三维物理世界的方向。在Sora等视频生成模型竞争加剧的背景下,世界模型被视为通向空间智能的关键赛道,此次发布意味着该方向又添一名重量级玩家。

关键信息

  • 李飞飞发布其首个多模态世界模型Atlas,正式亮相
  • Atlas采用从零开始预训练的路线,不基于现有大模型改造
  • 官方称仅需几张图像即可构建出世界场景,样本效率是核心卖点
  • 世界模型方向竞争升温,与视频生成、空间智能等路线同台竞技

🔥犀利点评

从零预训练是个漂亮的姿态——意味着不被现有大模型的偏见锁死,但也意味着烧钱、烧数据和漫长验证。几张图建世界听着惊艳,可演示视频和实际可用之间隔着无数坑,学术界成果落地商业产品的失败案例一抓一把。李飞飞的品牌效应无可置疑,但世界模型赛道上Google、Meta、Runway都在砸重金,Atlas真正的考验不是发布会,而是能否给出可量化的性能对标和清晰的落地路径。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文