🌍 空间智能

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
9月1日空间智能

李飞飞 World Labs 发布 Atlas:一张照片,生成一个可探索的 3D 世界

发生了什么

AI 教母李飞飞创办的 World Labs 发布 Atlas,被称为首个「多模态世界模型」:给它一张照片,它能构建出持久、可漫游的 3D 场景;沿指定镜头路径生成最长一分钟 1440p 视频;同一个空间表示还能输出深度图、点云和高斯泼溅——给下游图形软件直接用。人工评测中,Atlas 在 75%—94% 的对比试验中优于同类视频生成模型。

为什么重要

语言模型学的是「文字里描述的世界」,Atlas 走的是另一条路:直接学习「空间本身」。李飞飞称之为「空间智能」,认为这是 AI 理解物理世界的必经之路。

白话解读

对普通行业,这意味着新的内容工具:文保单位可以把一张老照片变成能「走进去」的场景做展览,电商可以把商品图变成可环视的 3D 展厅,影视前期可以用一张概念图预演机位。顺带一提,镇江老照片图集里的那些街景,理论上也存在被「复活」成可漫游场景的一天——技术已经在门口了。

单图生成3D可漫游1440p视频
Stanford Tech Review
← 上一篇:DeepSeek V4.1-Flash:把前… 下一篇:微信内测「小微AI社交」:AI 替你去和别人… →
延伸阅读
具身智能

小鹏人形机器人自动化产线启用:核心制程自动化率超 80%

创作工具

创作工具集体「长脑子」:达芬奇接入 AI 助手,Prime Video 告别对不上嘴型

生活场景

AI 打车、AI 配音、全屋智能:变化正在身边发生

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。