讲真的,看到World Labs(李飞飞创办的AI公司)发布Atlas那两天,我脑子里一直转着一个反差极大的数字:一百多家公司说自己在做世界模型,但按照预训练的标准认真卡一卡,可能就三到五家。这不是我随口编的,是虎嗅网和公众号“AI闹”引述的一位头部VC合伙人的判断。2026年9月2日,World Labs正式发布下一代世界模型Atlas,品玩首发报道,IT之家随后给了很细的技术拆解。按官方说法,Atlas是“全球首个多模态世界模型”,从零开始预训练,原生支持文本、图像、视频和3D联合处理。
先解释一句,世界模型不是只会聊天的AI,它得理解空间、时间和物理规律,能预测一个场景里下一步会发生什么。Atlas这次真正扎眼的,也不是能生成一分钟1440p视频,而是它把相机控制、空间重建、时空模拟和图像生成放进了一个管线里。官方说,它能从一张甚至数十张图像重建真实场景,还能给出显式三维输出。简单讲,它不只是生成一段好看的画面,而是开始把“3D资产”这件事从传统建模软件里往外拽。