扬声·CNDoor.Vip 首页 资讯 业界动态 查看内容

李飞飞的World Labs发布世界模型Atlas:几张图就能重建场景、生成长达1分钟高清视频 ...

2026-9-4 07:04| 发布者: 糖糊碌| 查看: 42| 评论: 0

摘要: AI 圈又一枚重磅炸弹落地——由著名AI学者李飞飞创办的 World Labs,昨晚正式发布了新一代世界模型 Atlas。这家 2024 年才成立的公司,这次没有做"聊天机器人",而是想让 AI 真正"看懂并重建我们身处的三维世界"。 A ...

李飞飞 World Labs Atlas 世界模型

AI 圈又一枚重磅炸弹落地——由著名AI学者李飞飞创办的 World Labs,昨晚正式发布了新一代世界模型 Atlas。这家 2024 年才成立的公司,这次没有做"聊天机器人",而是想让 AI 真正"看懂并重建我们身处的三维世界"。

Atlas 能干什么? 据了解,它是一个从零开始预训练的全域模型,能同时处理文字、图片、视频和 3D 数据,主要本领有三块:

  • 可控运镜:给一张或几张图,它就能生成最长 1 分钟、1440p(超高清)的视频,而且镜头怎么动、相机放哪,创作者都能像"下达精确坐标"一样控制,不像过去只能"碰运气式"让 AI 随便生成一段。
  • 空间重建:给它一张或几十张现场照片,它能重建出真实的场景,连"照片没拍到的那一面"也能按逻辑补全,还能直接输出成 3D 模型——据官方称效果优于目前最强的专用 3D 重建模型。
  • 时空模拟:它能通过视频学习空间和时间的变化,既能为影视画面重做特效,也能为机器人搭"真实到模拟"的训练环境,让机器人先在虚拟世界里反复练手。

为什么值得关注? 关键在于,交出这份成绩的并非 OpenAI、谷歌这类巨头,而是一支 2024 年才组建的小团队。李飞飞曾推动 ImageNet 改变了整个 CV(计算机视觉),这次 Atlas 被视为她"空间智能"路线的一次集中展示——不仅认得画面里"有什么",还要知道物体"在哪"、换个角度看是什么样。

Atlas 目前还只是面向部分合作伙伴开放早期访问,并非全面上线,未来会支撑 World Labs 的 Marble 等产品。据了解,公司背后已集齐英伟达、AMD、Autodesk、Fidelity 等投资方,今年 2 月刚新增 10 亿美元融资——可见资本对这一"空间智能"路线相当看好。

来源:InfoQ(《李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界》,2026-09-03)

原文链接:https://www.infoq.cn/article/9YiEhb3hAFtUlxOpMdGC


鲜花

握手

雷人

路过

鸡蛋
扬声 · CNDoor.Vip 汇聚 AI 资讯、办公效率、写作、图鉴等实用内容,为新手提供从入门到上手的 AI 指南。我们相信:AI 不该只是技术圈的事——把复杂的事说人话,让每个人都用得上。
  • 手机博客
  • 手机扬声
Copyright © 2014-2026 扬声 · 菜鸟门 版权所有 All Rights Reserved. 冀ICP备2025120842号
关灯 返回顶部
返回顶部