快速了解本文
李飞飞创办的 World Labs 完成 12 亿美元融资并发布世界模型 Atlas。
Atlas 支持从单图生成高清视频及重建几何一致的 3D 资产。
该模型旨在构建机器人可交互的 Real-to-Sim 仿真环境。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 李飞飞创办的 World Labs 已完成 12 亿美元融资,投资方包括 Nvidia、AMD 与 Autodesk,并发布其称为“omni model”的世界模型 Atlas。Atlas 从零预训练于文本、图像、视频与 3D 数据,架构为多模态自回归扩散 Transformer,可从提示生成、重建与模拟 3D 环境,体现公司将空间智能作为通用能力底座的产品策略。
Atlas 的核心能力包括:从单张图像生成长达 1 分钟、分辨率 1440p 的视频并支持像素级相机控制;从少至一张图像重建真实场景并输出几何一致的 3D 资产。World Labs 表示,在相机路径遵循的盲评中,Atlas 优于 Gemini Omni Flash 与 FLUX,但该结果为公司自述,尚未见独立第三方复现。
在应用指向上,Atlas 同时覆盖 VFX 与游戏设计,但 World Labs 强调其“真正目标”是机器人:支持用普通智能手机采集物理空间,构建机器人可导航与交互的 Real-to-Sim 仿真。Atlas 将驱动公司既有产品 Marble 及未来产品线。
Atlas 面临多方竞争。其直接对手包括 Google 的 Gemini Omni,并与字节跳动 Seedance 2.5、Google Veo 等视频生成模型存在能力重叠;Dealroom 同时指出,今年成立的多家中国初创公司也在竞速构建世界模型,赛道竞争正在加剧。

