世界模型WORLD MODELS · 月更
ORGANIZATION · 企业实验室 · 英国

Google DeepMind

Dreamer 与 Genie 两条线同时押注,是世界模型领域投入最深的机构。

这家机构在做什么

DeepMind 是这个领域投入最深、押注路线最多的机构:一条是达尼亚尔·哈夫纳主导的 Dreamer 系列,把「在梦境里训练、拿到现实里能用」做成路线 1(基于模型的强化学习)的旗舰配方;另一条是 Genie 系列,押注路线 3——不靠动作标注,只从视频里学出一个能实时走进去的可交互世界。

两条线都拿出过硬交付。DreamerV3 用同一套超参数跨 150 多个任务超越各领域专用方法,2025 年发表于《自然》(Nature 640, 647–653);Genie 3 于 2025 年 8 月发布,能以 720p、24fps 实时生成场景,环境一致性可维持数分钟(官方口径)。

但两条线眼下都添了变数。Genie 3 至今没有发表论文,外界只能看官方精选演示,无法独立复现验证;2025 年 11 月,在 DeepMind 工作近十年的哈夫纳宣布离职,去向未公开(据其本人社交媒体账号 x.com/danijarh 及 36kr 报道);2026 年 8 月上旬 DeepMind 又经历高层重组,首席执行官哈萨比斯卸任 CEO、转任 Alphabet 首席科学家兼 Google DeepMind 董事长,原首席技术官考瑞·卡武克奥卢升任 Google DeepMind 高级副总裁、直接向 Sundar Pichai 汇报(据 Axios、Fortune 等报道)。两条曾经并驾齐驱的路线能否保持同等投入,眼下还看不清。

旗下模型 · 9 个 · 自动聚合
PlaNet
2018-11
路线1 MBRL
RSSM 循环状态空间模型,纯隐空间规划。
DreamerV1
2019-12
路线1 MBRL
《Dream to Control》:把梦境训练做成通用配方。
DreamerV2
2020-10
路线1 MBRL
离散隐变量,首个 Atari 达人类水平的世界模型内智能体。
DreamerV3
2023-01
路线1 MBRL
单套超参跨 150+ 任务,Nature 2025,从零采到钻石。
Genie 1
2024-02
路线3 视频模拟器
从无标注视频无监督学出潜在动作与可玩 2D 世界。
GameNGen
2024-08
路线3 视频模拟器
扩散模型 20fps 实时跑 DOOM。
Genie 3
2025-08
路线3 视频模拟器
无标注视频学出可交互世界,文本事件注入。
RT-1
2022-12
路线4 具身/VLA
离散动作 Transformer 策略,真机大规模数据先行者。
RT-2
2023-07
路线4 具身/VLA
VLM 权重直出机器人动作,VLA 概念确立。
关键人物
达尼亚尔·哈夫纳
Danijar Hafner
DeepMind · Dreamer 系列作者 · 关联:路线 1

从 PlaNet 到 DreamerV4 的十年长跑:RSSM、离散隐变量,一路把「梦境训练」做成通用配方。DreamerV3 无人工数据从零采到 Minecraft 钻石,2025 年登上 Nature——经典 MBRL 路线最有耐心的证明。

一套超参,跑遍一百五十个任务,才叫通用。
Genie 团队
Parker-Holder & Fruchter 等
Google DeepMind · 关联:路线 3

三代 Genie 的核心问题只有一个:能否不靠任何动作标注,让模型从视频里自己悟出「按键 → 后果」?从 2D 平台游戏到 720p 可交互 3D 世界,他们把「可玩性」变成了世界模型的试金石。

世界模型的试金石是可玩,不是好看。
← 回到机构列表
机构档案为人工撰写;旗下模型列表由模型库数据自动聚合。术语表 →最后更新 2026-08