返回今日选题

已核验 · Aug 11, 2026

已独立佐证

创作者用世界模型:3D 场景 asset vs 交互体验 —— 什么时候用 RTFM,什么时候用 Genie 3

3 个信源

World Labs RTFM 和 DeepMind Genie 3 是映射到两个不同创作者用例的世界模型面。RTFM 从单张图产出 3D 场景 asset —— asset 可以导出到 3D pipeline(Blender / Unity / Unreal),用作静止场景,或嵌入视频。Genie 3 产出交互体验 —— 用户实时导航生成的环境,体验住在 Genie runtime 里,而不是可导出的 asset。创作者根据用例挑选:可导出的 3D asset → RTFM,交互体验 → Genie 3。

为什么现在讲

两个同一周发了 —— 创作者现在可以为他们的世界模型需求在可导出的 3D asset(RTFM)和交互体验(Genie 3)之间挑选。

推荐理由

演示空间:同一场景在 RTFM 导出 asset vs Genie 3 交互体验上的并排,对比导出 vs 交互。

依据

两个独立 vendor 一手源 + The Decoder 周报

World Labs RTFM 和 DeepMind Genie 3 本周一起发 —— 它们映射到两个不同创作者用例:可导出 3D asset(RTFM)vs 交互体验(Genie 3)。

切入角度

把两个框成「可导出 3D asset vs 交互体验」 —— 根据创作者需要可导出 asset(RTFM)还是 runtime 体验(Genie 3)挑选。

形式

口播短视频

演示想法

录一段 6 分钟讲解:2 分钟讲「可导出 vs 交互」框架,2 分钟讲 RTFM(可导出 3D asset),2 分钟讲 Genie 3(交互体验)。

平台注意

具体 asset 导出格式和 Genie 3 交互模型细节(超出本次捕获范围)未抽取;在记录具体面细节之前,对照 vendor 一手文档确认。

可用说法

  • World Labs 发布 RTFM —— 实时前馈 3D 世界模型,无需逐场景优化即可从单张图像生成 3D 场景。
  • Google DeepMind 发布 Genie 3 GA —— 交互式世界模型,让用户在生成环境中实时导航和交互。

证据链

拆解

RTFM 产出可导出的 3D 场景 asset;Genie 3 产出交互体验。本篇用 asset vs 体验框架作为挑世界模型的 lens,而不是把「世界模型」当成单一品类。

风险

  • The Decoder 和 IT之家可用作媒体类佐证,但在对外表述任何具体能力或跑分声明前,请先阅读厂商原始文档。在对外表述前,请对照厂商原始文档和实际许可 / 定价矩阵核实具体能力声明;不要把各平台定价或许可条款转述成具体美元数字或商业使用条款。
  • 厂商文档确认了实时 / 交互能力,但超出所捕获摘要的具体延迟目标本次未提取。在对外表述前,请对照厂商原始文档和实际许可 / 定价矩阵核实具体能力声明;不要把各平台定价或许可条款转述成具体美元数字或商业使用条款。

演示思路

  • 并排:同一场景在 RTFM 导出 3D asset vs Genie 3 交互体验
  • 工作流决策:「哪个世界模型配哪个创作者用例」(可导出 asset → RTFM,交互体验 → Genie 3)
  • pipeline 集成:「RTFM 生成的 3D 场景导入 Blender + Genie 3 交互 runtime」,量工作流 delta