LLMWIKI · ENTITY
DeepSeek 与幻方量化(High-Flyer Quant)
2025-2026 年中国 AI 最震撼的故事——一家量化对冲基金的 GPU 集群孵化出了与 OpenAI/Anthropic 对垒的开源大模型。武器化开源 + mHC 算法 + R1 推理模型成为撬动美国 AI 资本护城河的杠杆
免费开放 · 更新于
TL;DR2025-2026 年中国 AI 最震撼的故事——一家量化对冲基金的 GPU 集群孵化出了与 OpenAI/Anthropic 对垒的开源大模型。武器化开源 + mHC 算法 + R1 推理模型成为撬动美国 AI 资本护城河的杠杆
DeepSeek(深度求索)是 2025-2026 年中国 AI 生态中最震撼的存在^1——它的母公司不是大学,不是 BAT,而是一家量化对冲基金 幻方量化(High-Flyer Quant)。
这个出身揭示了 AI 行业的底层秩序转移:拥有大规模 GPU 用于高频交易的金融机构,竟然成了 AI 算力的"隐形富豪"。
出身:从对冲基金到 AI 实验室的反直觉路径
graph LR
A[幻方量化<br/>2015 年成立] --> B[为高频交易<br/>买入巨量 GPU]
B --> C[2021 年组建<br/>萤火二号集群<br/>10000 张 A100]
C --> D[2023 年成立<br/>DeepSeek 子公司]
D --> E[2024 年 12 月<br/>DeepSeek V3 发布]
E --> F[2025 年 1 月<br/>R1 模型震动美股]
F --> G[2025-2026<br/>持续迭代<br/>开源大模型代表]反直觉点:高频交易需要的算力规模和 AI 训练高度重合——两者都需要大规模并行计算 + 低延迟通信 + 海量数据预处理。一家量化对冲基金顺手就具备了世界级 AI 实验室的硬件基础。
核心创新:mHC 流形约束超连接
DeepSeek 提出的流形约束超连接(Manifold-Constrained Hyper-Connections,mHC):
| 维度 | 传统 Transformer | mHC |
|---|---|---|
| 残差连接 | 单一恒等映射 | 多个学习到的连接 |
| 计算开销 | 基线 | 不增加 |
| 性能提升 | 基线 | 显著 |
| 训练稳定性 | 经常需调优 | 自动稳定 |
这是 AI 智力通缩 的算法效率驱动力之一。
武器化开源:商品化作为反护城河武器
DeepSeek 走 MIT License(最宽松开源许可证)——这不是慈善,是战略:
graph TB
A[美国芯片禁令] --> B[中国传统应对路线<br/>自研芯片 + 国产替代]
A --> C[DeepSeek 反应对路线<br/>武器化开源]
C --> D[把美国公司试图通过 API 围墙<br/>保护的知识产权<br/>商品化]
D --> E[摧毁 OpenAI/Anthropic 的<br/>资本护城河]
E --> F[全球南方采用<br/>非洲、东南亚、南美<br/>事实标准变成中国架构]
F --> G[长期地缘政治隐患]全球南方的事实标准:未来全球一半人口的 AI 基础层可能运行在中国架构之上——这是美国通过 EXIM 银行、商务部、五眼联盟反复想阻止的局面。
R1 的"斯普特尼克时刻"
2025 年 1 月 R1 发布带来的市场震动:
- 美股 AI 板块单日蒸发约 1 万亿美元
- Nvidia 单日股价跌幅 17%
- "美国 AI 永远保持质量领先"的假设被打破
R1 的关键能力——推理时计算扩展(Test-Time Compute Scaling):
| 维度 | GPT-4 | DeepSeek R1 |
|---|---|---|
| 训练成本 | $100M+ | 声称 $6M(争议有外延成本未计算) |
| 数学奥赛 AIME | 13.4% | 79.8% |
| 编程 LiveCodeBench | 32.9% | 65.9% |
| 许可证 | 闭源 | MIT 完全开源 |
Kimi K2 Thinking:第二波震荡
2025 年底月之暗面发布 Kimi K2 Thinking——延续 DeepSeek 路线但更进一步:
- 在 Humanity's Last Exam(复杂推理)上匹敌或超越 GPT-5 级闭源模型
- 消费级硬件就能跑
- MIT License 完全开源
这两波震荡共同确立了中国"小科技"力量的工业现实——不是传统科技巨头主导,而是对冲基金 + AI 初创这种非传统玩家。
中美 AI 生态的双寡头确认
a16z 的 Marc Andreessen 在 2026 战略展望中确认:到 2026 年,AI 领域实际上形成了双寡头垄断——没有任何其他地区(包括欧盟)拥有与中美相匹敌的完整技术栈。
| 维度 | 美国 AI | 中国 AI |
|---|---|---|
| 代表 | OpenAI / Anthropic / Google | DeepSeek / 月之暗面 / 阿里通义 |
| 模式 | 闭源 + API + 资本护城河 | 开源 + 应用反哺 |
| 优势 | 算法引领 + 芯片 + 资本 | 数据 + 工程 + 完整产业链 + 国家动员 |
| 战略 | 通过 EXIM/商务部维护领先 | 武器化开源 + 商品化 |
详见 应用层反哺模型层、AI 智力通缩。
与频道既有概念的链接
- AI 智力通缩:DeepSeek 是其核心驱动力之一
- 国际关系中的四类博弈:武器化开源 = 猎鹿博弈
- 应用层反哺模型层:中国"小科技"的商业模式逻辑
- 国家账本审计:地缘政治维度的延伸
一句话总结
DeepSeek 是 AI 时代的"幻方化反"——一家做高频交易的对冲基金顺手做出了世界级开源大模型,用最锋利的方式证明:在 AI 时代,资本不再是最高级的护城河,算法效率才是。