返回今日选题

已核验 · Aug 11, 2026

已独立佐证

实时 3D + 交互式世界模型:RTFM + Genie 3 —— 让世界模型成为创作者可研究的属性

3 个信源

World Labs RTFM(实时前馈 3D 生成,从单张图,不用 per-scene 优化)和 DeepMind Genie 3 GA(交互式世界模型 —— 用户可以实时导航和交互生成的环境)同一周都发了实时 + 交互里程碑。两者并不等价:RTFM 是实时生成(3D 场景出现得快);Genie 3 是实时交互(用户可以实时导航场景)。两者合起来让世界模型成为创作者可研究的对象:RTFM 给创作者一个快速 3D asset,Genie 3 给创作者一个交互体验。

为什么现在讲

两个同一周发了 —— 创作者现在可以把世界模型研究为快速生成(RTFM)或交互体验(Genie 3)。

推荐理由

演示空间:RTFM 生成 asset + Genie 3 让用户导航同一 3D 场景的并排。

依据

两个独立 vendor 一手源 + The Decoder 周报

World Labs RTFM 和 DeepMind Genie 3 本周一起发 —— 两者合起来让世界模型成为创作者可研究的对象:RTFM 用于实时 3D 生成,Genie 3 用于实时交互导航。

切入角度

把两个框成「实时生成 vs 实时交互」世界模型面 —— RTFM 用于快速 3D asset,Genie 3 用于交互体验。

形式

长视频讲解

演示想法

录一段 10 分钟讲解:3 分钟讲「实时生成 vs 交互」框架,3 分钟讲 RTFM(单图 3D 生成),3 分钟讲 Genie 3(交互导航),1 分钟做下注对比。

平台注意

具体延迟目标和逐环境支持(超出本次捕获范围)未抽取;在记录具体面细节之前,对照 vendor 一手文档确认。

可用说法

  • World Labs 发布 RTFM —— 实时前馈 3D 世界模型,无需逐场景优化即可从单张图像生成 3D 场景。
  • Google DeepMind 发布 Genie 3 GA —— 交互式世界模型,让用户在生成环境中实时导航和交互。

证据链

拆解

RTFM 是实时生成(3D 场景出现得快);Genie 3 是实时交互(用户实时导航场景)。本篇让两个实时属性保持各自独立,而不是把「实时」当成单一能力。

风险

  • The Decoder 和 IT之家可用作媒体类佐证,但在对外表述任何具体能力或跑分声明前,请先阅读厂商原始文档。在对外表述前,请对照厂商原始文档和实际许可 / 定价矩阵核实具体能力声明;不要把各平台定价或许可条款转述成具体美元数字或商业使用条款。
  • 厂商文档确认了实时 / 交互能力,但超出所捕获摘要的具体延迟目标本次未提取。在对外表述前,请对照厂商原始文档和实际许可 / 定价矩阵核实具体能力声明;不要把各平台定价或许可条款转述成具体美元数字或商业使用条款。

演示思路

  • 并排:RTFM 生成 3D 场景,Genie 3 让用户导航
  • 工作流故事:「用 RTFM 生成 3D asset + Genie 3 加交互导航」,量 time-to-interactive-experience
  • 面矩阵:把 RTFM vs Genie 3 画在生成速度 vs 交互速度 vs asset 格式上