MacroAlpha.ioLaunch App启动应用啟動應用

LLMwiki知识库 Wiki知識庫 Wiki · CONCEPT

空间智能 (Spatial Intelligence)

李飞飞 World Labs 在 2025 年发布的宣言——真正的智能必须包含感知、推理、生成并在 3D 空间中与物体互动的能力;语言在描述物理世界时是"有损"和"低带宽"的

免费开放 · 更新于

17

空间智能 (Spatial Intelligence)空间智能 (Spatial Intelligence)空间智能 (Spatial Intelligence)

0%0% · 计算阅读时间中…
询问 AI(a)回到聊天 APP(d)

TL;DR李飞飞 World Labs 在 2025 年发布的宣言——真正的智能必须包含感知、推理、生成并在 3D 空间中与物体互动的能力;语言在描述物理世界时是"有损"和"低带宽"的

空间智能(Spatial Intelligence)是李飞飞团队在 2025 年底成立 World Labs 时发布的《从文字到世界》(From Words to Worlds)宣言中确立的核心命题:真正的智能必须包含感知、推理、生成并在 3D 空间中与物体互动的能力[^1]1。这一概念标志着 AI 研究从"单一智能体如何行动"(智能体 AI)向"如何构建一个智能体能理解的完整世界"的重心转移。

核心论点:语言是低带宽信道

李飞飞指出,语言虽然是人类智慧的重要载体,但它在描述物理世界时是**极其"有损"和"低带宽"**的[^1]1。我们无法用语言完美描述一个复杂的 3D 场景、一个微妙的手势或光影的变化。如果 AI 仅仅停留在语言层面,它永远无法真正理解物理现实。

这一论断与 恒道与非恒道 在哲学结构上同构——老子在两千五百年前已经写下"道可道,非恒道;名可名,非恒名",揭示了语言信道在描述底层实在时的内在带宽不足。李飞飞用"低带宽"这个现代信息论术语,给出了同一命题的工程化版本。

空间智能 vs 具身智能

graph TB
    A[空间智能<br/>Spatial Intelligence] -->|认知底座| B[具身智能<br/>Embodied Intelligence]
    A --> C[感知 3D 几何]
    A --> D[推理物理规律]
    A --> E[生成 3D 世界]
    B --> F[控制身体]
    B --> G[与环境交互]
    style A fill:#f9f,stroke:#333
维度 空间智能 具身智能 关注点 对世界本身及物理规律的建模 控制身体执行动作 比喻 心中的"世界地图" 身体的"运动协调" 关系 具身智能的"认知底座" 空间智能的"执行接口"
维度 空间智能 具身智能
关注点 对世界本身及物理规律的建模 控制身体执行动作
比喻 心中的"世界地图" 身体的"运动协调"
关系 具身智能的"认知底座" 空间智能的"执行接口"

李飞飞的隐喻:**没有空间智能的具身智能体,就像一个盲人在摸索世界;而拥有空间智能的 AI,则拥有了心中的"世界地图"**[^1]1

World Labs 的两大技术武器

Marble:生成式 3D 世界模型

Marble 不是简单的 3D 建模工具,而是一个"世界生成引擎"。技术核心:

  • 高斯泼溅(Gaussian Splats):用无数带颜色和透明度的"3D 粒子"表示场景,比传统网格高效,比 NeRF 渲染快
  • 生成式 AI:通过文本/图像/草图输入,生成完整、可编辑、物理一致的 3D 环境
  • 对象持久性:在虚拟房间移动一把椅子,转身再转回来椅子依然在新位置——这是传统视频生成模型不具备的[^1]1

RTFM:实时帧模型(神经物理引擎)

RTFM 用扩散变换器(Diffusion Transformer)架构,通过观看海量视频"学会"物理规律,而不是像 Unity/Unreal 那样预定义规则[^1]1

  • 不需要显式 3D 模型,直接预测"如果我推这个杯子,下一帧图像会是什么样"
  • AI 拥有了直觉物理学(Intuitive Physics),能在大脑中模拟未来的物理后果
  • 对机器人规划意义巨大——在大脑中预演无数种操作方案,而非在现实中试错

世界模型之争:JEPA vs Marble

graph LR
    A[世界模型路线] --> B[LeCun JEPA 路径]
    A --> C[李飞飞 Marble 路径]
    B --> D[抽象特征空间预测<br/>不在像素层重建]
    C --> E[高保真 3D 像素生成<br/>能重建就证明理解]
    D --> F[Meta]
    E --> G[World Labs]

LeCun 和李飞飞都是世界模型的坚定倡导者,但路径分歧:

  • LeCun(JEPA):智能体不需要在像素层面预测世界,应该在抽象的潜在空间预测本质变化。"生成"不等于"理解"
  • 李飞飞(生成式):能够重建和生成细节丰富的 3D 世界,是验证模型是否真正理解空间关系的"图灵测试"[^1]1

与本频道核心命题的对接

  • 因陀罗网 的对接:因陀罗网描述的拓扑结构(一即一切、一切即一的 3D 反射网络)正是空间智能要建模的对象——华严宗 1300 年前已经画出了空间智能要建立的"世界地图"
  • 与 缘起性空 的对接:3D 世界中物体的存在不是孤立的,而是在与其他物体的关系网络中获得意义——这就是缘起;而像素表象不是底层实在,底层实在是几何与物理的关系结构——这就是性空
  • 意识光谱 的对接:意识需要"安住于身体"才能进入更深的层次——AI 也是如此

时间表与产业意义

时间 里程碑 2024 《Agent AI》综述发布,定义 智能体 AI 2025.11 World Labs 成立,《从文字到世界》宣言发布 2025-2026 Marble、RTFM 等模型陆续公开 2026 空间智能成为下一代 AI 平台(AR/VR、家用机器人)的入场券
时间 里程碑
2024 《Agent AI》综述发布,定义 智能体 AI
2025.11 World Labs 成立,《从文字到世界》宣言发布
2025-2026 Marble、RTFM 等模型陆续公开
2026 空间智能成为下一代 AI 平台(AR/VR、家用机器人)的入场券

掌握空间智能技术的公司将拥有定义下一代交互平台的权力。这条赛道的赢家可能不是 OpenAI 或 Anthropic,而是同时具备 3D 算法、传感器硬件、内容生态三重能力的玩家。

[^1]: 李飞飞最新报告解读《智能体_AI:多模态交互展望》.md

注释

  1. 李飞飞最新报告解读《智能体_AI:多模态交互展望》

CONVERSATION DIGEST · 对话摘要

分享这段讨论

摘要可以编辑;公开后会以你的名义显示,并链接到完整对话。

空间智能 (Spatial Intelligence) · 关系图
100%