世界模型WORLD MODELS · 月更
ORGANIZATION · 企业实验室 · 中国

字节跳动 Seed

ByteDance Seed

视频生成(Seedance)与具身 VLA(GR-3)两路并进,世界模型是公开设定的年度目标。

这家机构在做什么

字节跳动 Seed 团队在两条路线上都有拿得出手的东西:路线 3 是 Seedance 系列视频生成模型,路线 4 是 GR-3 视觉-语言-动作模型配自研的 ByteMini 双臂移动机器人(arXiv:2507.15493)。但把它放进这个站,最有意思的不是成果,而是它公开留下的落差。

Seedance 2.0 的论文标题写着《Advancing Video Generation for World Complexity》——「面向世界复杂性」——但通读摘要,没有任何一句涉及物理模拟、因果推演或世界建模,全部篇幅在讲多模态输入、参考编辑能力、4 到 15 秒时长和 480p/720p 分辨率(arXiv:2604.14148)。这是本站反复强调的那个模式的又一个标本:「world」出现在标题里,证据不在论文里。

另一面则罕见地坦率。据 36Kr 2026 年的独家报道(媒体转述的内部说法,非官方口径),Seed 负责人吴永辉给团队定的年度目标是「年底前至少发布一个世界模型」并对标 Genie 3;同一报道称,2026 年初的内部测试显示字节的世界模型表现比全球最好水平落后约一成,吴本人多次在内部会议上表示世界模型与具身智能的成果不及预期。这个数字无法回溯到任何一手来源,读者应当把它当作行业传闻而非可核对指标;但一家有充足算力与数据的大厂公开承认在这条路线上落后,本身就是对「世界模型很难」这件事的一个旁证。

旗下模型 · 2 个 · 自动聚合
Seedance 2.0
2026-02
路线3 视频模拟器
论文标题写着「面向世界复杂性」,摘要里没有一句世界建模。
GR-3
2025-07
路线4 具身/VLA
字节自研 VLA,配双臂移动机器人 ByteMini,论文称在多项任务上超过 π0。
← 回到机构列表
机构档案为人工撰写;旗下模型列表由模型库数据自动聚合。术语表 →最后更新 2026-08