MacroAlpha.io
Launch App启动应用

LLMWIKI · CONCEPT

莫拉维克悖论 (Moravec's Paradox)

1988 年汉斯·莫拉维克在《心智的后代》提出 · 人类觉得最难的事 (解数学、下棋、写代码) AI 已做到顶尖 · 人类觉得最简单的事 (走路、抓东西、认脸) AI 仍在挣扎 · 因为感知运动是十亿年进化优化的厚冰山,理性思考只是几百万年的薄表皮

免费开放 · 更新于

TL;DR1988 年汉斯·莫拉维克在《心智的后代》提出 · 人类觉得最难的事 (解数学、下棋、写代码) AI 已做到顶尖 · 人类觉得最简单的事 (走路、抓东西、认脸) AI 仍在挣扎 · 因为感知运动是十亿年进化优化的厚冰山,理性思考只是几百万年的薄表皮

1988 年卡内基梅隆大学机器人学教授汉斯·莫拉维克 (Hans Moravec) 在《心智的后代》中提出的核心洞察:

让计算机在智力测试或下棋上达到成年人水平相对容易;但要让它们拥有一岁小孩在感知和行动方面的能力,却极其困难,甚至不可能。

这不是技术尚未成熟的暂时现象,而是关于智能本身的结构性秘密:智能不是一种东西,而是多层能力的地质堆叠。

冰山结构

graph TD
    A["AI 已掌握的能力<br/>语言 / 推理 / 数学 / 编程<br/>(人类引以为豪的部分)"]
    B["AI 仍在挣扎的能力<br/>视觉 / 运动 / 抓握 / 平衡 / 面部识别"]
    C["进化时间表"]
    A -.-> A1["几百万到几千年<br/>最年轻的能力"]
    A1 -.-> A2["自然选择未充分优化<br/>需'费力'地意识到自己在思考"]
    B -.-> B1["几亿到十几亿年<br/>从单细胞时代开始进化"]
    B1 -.-> B2["精密到无法被意识感知<br/>'自动发生'"]
    note["莫拉维克核心论断:<br/>越意识不到的能力底层越复杂"]

五个独立证据链

证据一:明斯基的精辟总结

MIT 的马文·明斯基 (Marvin Minsky) 用一句话点破了悖论的核心:

"总体来说,我们的大脑做得最好的那些事情,恰恰是我们最没有意识到的。"

证据二:布鲁克斯的偏见诊断

iRobot 联合创始人罗德尼·布鲁克斯指出:早期 AI 研究者定义"智能"的方式,基本上就是"受过高等教育的男性科学家觉得困难的事情"——下棋、证明定理、解方程。至于四五岁小孩毫不费力就能做到的事情——区分杯子和椅子、两条腿走路——没人觉得需要"智能"。

证据三:抓杯子的计算复杂度

一个两岁孩子伸手拿杯子不到一秒钟。同样的动作用程序实现需要:

  • 视觉识别 (杯子 vs 背景 vs 其他物品)
  • 三维位置 / 方向 / 形状判断
  • 运动轨迹规划 (避障 + 抓取角度)
  • 实时调整 (视觉信息持续更新 + 肌肉力反馈)
  • 力度控制 (太轻滑落 / 太重捏碎)

涉及的自由度、反馈回路、实时校正的计算量是天文数字级别。

证据四:2025 的现代版莫拉维克悖论

俄亥俄州立大学的 Yu Su 提出"现代版莫拉维克悖论"——AI 在数学和编程上以令人目瞪口呆的速度进步 (奥数金牌、99% 编程竞赛超越人类),但操作电脑界面这种人类觉得轻而易举的事情,进展却慢得令人沮丧。computer use agent 的不稳定性,本质上和机器人抓杯子是同一个问题。

证据五:Physical Intelligence 的具身实验

2024-2025 年间,Physical Intelligence 公司用机器人完成"简单"任务:把花生酱抹到面包上、洗油腻的锅、把钥匙插进锁里、把袜子翻面。每一个都是世界级技术难题。你做起来不用想,对机器人来说是数十亿年进化的对手。

数据可得性视角的新解读

莫拉维克悖论在 2025 年有了一个更深的解释维度:

AI 最擅长的,恰恰是人类花了最多精力去显性化、去文字化、去记录的那些能力。AI 最弱的,是人类从来不觉得需要记录的那些能力——因为它们太自然了。

互联网上有海量数学论文、棋谱、代码,却几乎没有"如何走路""如何抓杯子"的数据。没人会写论文教你抓杯子,所有人都在写论文教你解微分方程

这与 万亿参数 那期"参数是知识关系的几何形状"的判断一致——LLM 通过压缩文本学到了推理,但它学不到那些从未被语言化的知识

与频道核心概念的深层连接

连接一:与"道可道,非常道"

道德经开篇就讲过的事情。最深层的知识不在语言里,因为它们从来就不是以语言形式存在的。它们是身体知道的,不是头脑知道的。莫拉维克悖论用 AI 失败的方式证明了同一个判断。

连接二:与三自性模型 (依他起 vs 遍计所执)

莫拉维克的冰山 唯识的三自性
水面上的薄表皮 (理性思考) 遍计所执 — 叙事叠加的自我,最表层最不精密
水面下的巨大主体 (感知运动) 依他起 — 底层因缘数据流,真正复杂强大的部分

连接三:与元神识神

修行者所说的"识神 vs 元神"的关系,和莫拉维克悖论描述的结构几乎是同构的:

  • 识神 — 日常意识、语言逻辑、大脑皮层默认模式网络 → 冰山露出水面的薄表层
  • 元神 — 深层意识状态、整合性意识 → 冰山水面以下的巨大主体

修行做什么?"致虚极,守静笃" — 让表层噪音安静下来,让更深层的智慧浮现。翻译成莫拉维克语言:暂时关闭你大脑中那个最年轻、最粗糙、最喧闹的模块,去感受运行了几十亿年的安静的、精密的底层系统

智能的两条进化路径

graph LR
    subgraph 生物进化路径
        Bio1[感觉] --> Bio2[运动] --> Bio3[本能] --> Bio4[情绪] --> Bio5[语言/理性]
    end
    subgraph AI 进化路径
        AI1[语言/理性] --> AI2[符号操作] --> AI3[多模态] --> AI4[具身控制] --> AI5[感知运动]
    end
    Merge[两条路径会汇合吗?] --> AGI[如果会,那就是 AGI<br/>如果不会,需要重新定义通用智能]

生物是从底层往上建——先有感觉再有运动再有本能再有情绪最后才有语言和理性。AI 是从顶层往下建——先有语言和理性,然后试图往下延伸到感知和运动。

这两条路径走的是相反方向。它们能不能最终汇合?目前的判断是:正在汇合,但不要低估融合的难度。几十亿年进化堆出来的东西,不是随便几万块 GPU 就能补上的。

终极启示

莫拉维克悖论最深的意义不是 AI 技术问题,而是关于人类自我认知的镜子

人类真正的"超级能力"不是我们引以为豪的理性思维——那只是薄薄的表皮。真正的超级能力是那些你根本意识不到的东西。

如果你只用你的理性、语言、逻辑思维去理解世界——你其实是在用冰山的尖尖去理解整座冰山。这大概就是为什么最深的智慧往往是"说不出来"的——因为它本来就不住在语言能够到达的地方。

频道相关视频

^1

莫拉维克悖论 (Moravec's Paradox) · 关系图