世界模型WORLD MODELS
PEOPLE · 立场之争即叙事

人物志

技术路线的分歧,最终都是人的分歧。天然的叙事冲突点:LeCun vs 生成派,以及贯穿三十年的 Schmidhuber 优先权之争。

于尔根·施密德胡伯
Jürgen Schmidhuber
IDSIA / KAUST · 「一切始于 1990」
1990 年写下《Making the world differentiable》时无人在意;三十年后每一个自称「世界模型」的系统都绕不开他的 M + C 范式。他把大半生用来提醒世界:这些想法我早就发表过——优先权之争成了他公众形象的一部分,也是理解这段历史的钥匙。
立场
你们的新突破,引用列表里应该有我 1990 年的论文。
关联:路线 0
大卫·哈
David Ha
Sakana AI · 《World Models》第一作者
2018 年与 Schmidhuber 合作的《World Models》让这个词重回聚光灯,而真正出圈的是那个能在浏览器里玩的交互式论文网页 worldmodels.github.io——它本身就是「生动讲解」的典范,也是本站的精神参照。
立场
在梦境中训练智能体,然后把策略搬回现实。
关联:路线 1
达尼亚尔·哈夫纳
Danijar Hafner
DeepMind · Dreamer 系列作者
从 PlaNet 到 DreamerV4 的十年长跑:RSSM、离散隐变量,一路把「梦境训练」做成通用配方。DreamerV3 无人工数据从零采到 Minecraft 钻石,2025 年登上 Nature——经典 MBRL 路线最有耐心的证明。
立场
一套超参,跑遍一百五十个任务,才叫通用。
关联:路线 1
杨立昆
Yann LeCun
AMI Labs 创始人 · 图灵奖得主
2022 年发布蓝图押注 JEPA:「生成像素是在浪费容量模拟树叶抖动。」当整个行业涌向视频生成,他反向而行;2025 年 11 月离开 Meta 创立 AMI Labs,次年拿下 10.3 亿美元种子轮——用真金白银继续这场反主流赌注。
立场
看起来对,不等于理解。
关联:路线 2
李飞飞
Fei-Fei Li
World Labs 联合创始人 · 斯坦福教授
从 ImageNet 到空间智能:她认为语言模型缺的是对三维世界的理解。World Labs 融资约 12.3 亿美元做 Marble;2026 年的《功能性分类》论文给混乱的行业立尺——渲染器 / 模拟器 / 规划器,你到底是哪一个?
立场
大多数「世界模型」只是渲染器,却当三合一来卖。
关联:路线 5
G
Genie 团队
Parker-Holder & Fruchter 等
Google DeepMind
三代 Genie 的核心问题只有一个:能否不靠任何动作标注,让模型从视频里自己悟出「按键 → 后果」?从 2D 平台游戏到 720p 可交互 3D 世界,他们把「可玩性」变成了世界模型的试金石。
立场
世界模型的试金石是可玩,不是好看。
关联:路线 3
朱兴
Zhu Xing
蚂蚁灵波 · 具身原生路线
国内锚点:LingBot-World 开源对标 Genie 3,LingBot-VA 用「视频预测 + 逆动力学」打通世界模型与机器人动作。开源周策略让灵波成为用图谱分析一家公司的最佳案例——见案例页。
立场
世界模型生来就该为具身智能服务。
关联:路线 3 / 4
争议如实呈现两边:优先权之争、Sora 之争、判别派 vs 生成派均给双方论点。最后更新 2026-07