李飞飞团队发布Atlas世界模型:重新定义AI对三维空间的理解

2026-09-02 15:14:42未知 作者:徽声在线

编辑|徽声在线科技频道

今日,人工智能领域迎来重磅消息:李飞飞创立的初创公司World Labs正式发布新一代世界模型Atlas。该模型演示视频中,李飞飞在办公室叠衣服的场景以惊人真实度呈现,引发科技圈热议。据官方视频链接显示,模型不仅还原了人物动作细节,连衣物褶皱和光影变化都达到以假乱真程度。

李飞飞在社交平台转发时幽默表示:「我们办公室确实在叠衣服,不过这次是AI帮我们完成的!」这条推文引发网友对技术原理的热烈讨论。

<

技术解析:全模态模型的革命性突破

Atlas被定义为omni model(全模态模型),其核心优势在于从零开始预训练,原生支持文本、图像、视频、3D空间四种数据模态的统一处理。World Labs官方技术文档强调,这是「全球首个实现像素级相机控制、图像视频生成与3D重建的多模态世界模型」。

四大核心能力矩阵

空间上下文:三维世界的「记忆宫殿」

Atlas的创新性体现在其空间上下文(spatial context)架构设计。该模型采用多模态自回归扩散Transformer结构,将每张输入图像锚定在三维空间坐标系中,携带相机位姿信息直接参与上下文构建。这种设计彻底改变了传统视频模型的运作方式:

更令人惊叹的是上下文编排能力。当输入两张无关图片并指定空间关系时,模型可自动补全中间场景。例如将站点图片与地面图片组合后,Atlas生成了包含门廊、走廊的完整过渡空间,展现出强大的空间推理能力。

技术架构与性能基准

Atlas采用混合架构设计,融合了LLM与视频模型的双重优势:

在性能评测方面:

应用场景:从内容创作到工业仿真

Atlas展现出广泛的应用潜力:

回顾World Labs的发展轨迹:2024年9月完成2.3亿美元融资,2025年推出Marble平台,2026年先后完成10亿美元融资(估值达50亿美元)并收购仿真公司SceniX。此次Atlas的发布,标志着公司从「视觉内容生成」向「物理世界建模」的战略转型。

正如李飞飞在技术白皮书中所言:「当世界模型不仅能创造美丽画面,还能构建可操作的物理环境时,AI将真正获得理解三维空间的能力。」Atlas的诞生,或许正是这个转折点的开始。

更多技术细节与演示案例,请访问World Labs官方博客

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势 马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求
相关文章
李飞飞团队发布Atlas世界模型:重新定义AI对三维空间的理解李飞飞团队发布Atlas世界模型:重新定义AI对三维空间的理解 智谱与MiniMax:大模型商业化的双轨进化论智谱与MiniMax:大模型商业化的双轨进化论 智谱天猫开店售Token:个人版月费118元起,团队版598元,引领AI零售新风尚智谱天猫开店售Token:个人版月费118元起,团队版598元,引领AI零售新风尚 马斯克预言:2027年底AI将全面接管数字领域,人类软件开发竞争力受挑战马斯克预言:2027年底AI将全面接管数字领域,人类软件开发竞争力受挑战 美光科技陷劳资纠纷 全球半导体福利竞赛升级美光科技陷劳资纠纷 全球半导体福利竞赛升级 Sonos Play深度体验:Wi-Fi与蓝牙双模音响的独特魅力Sonos Play深度体验:Wi-Fi与蓝牙双模音响的独特魅力