GAIA 系列把世界模型用于自动驾驶的可控场景生成。
Wayve 2017 年由剑桥大学两位博士生创立,押注一条务实的路线 4:用端到端深度学习直接把摄像头画面映射到驾驶动作,不依赖高精地图和人工规则;GAIA 系列生成式世界模型,则是为这套端到端系统批量生产训练场景与边缘案例(corner case)的引擎。
GAIA-1(2023-09,arXiv:2309.17080)是一个 90 亿参数的驾驶场景生成模型,能同时接受视频、文本和动作三种输入;GAIA-2(2025-03,arXiv:2503.20523)进一步支持多视角一致生成和结构化条件控制。2026 年 2 月 25 日,Wayve 完成 12 亿美元 D 轮融资,估值达 86 亿美元,投资方包括 NVIDIA、微软、Uber 和多家车企;公司计划与 Uber 在伦敦启动无人驾驶载客试运营,并已与日产签约,计划 2027 年起在量产车上部署其 AI 驾驶系统(公开报道)。
最大的不确定性是能否把「世界模型生成的训练数据」真正转化为公开道路上可信赖的自动驾驶表现:GAIA 系列至今主要以论文和技术演示的形式呈现,量产车队的真实安全数据尚未大规模公开披露,伦敦的载客试运营和日产的量产合作要到 2027 年才逐步落地,这条从生成式世界模型到规模化商业自动驾驶的链条能否如期兑现,还需要时间验证。