Runway 联创访谈:视频生成只是起点,目标是通用世界模拟器
Latent Space · youtube · 2026-09-25
Latent Space 播客专访 Runway 联合创始人 Anastasis Germanidis,回顾公司从创意工具到前沿视频模型(Gen-1 到 Gen-4.5)的演进,并阐述其更大野心:视频生成是通往通用世界模拟的路径。
关键内容:
- 早期押注 1000 张 A100 集群启动视频研究;Gen-2 源自一个周末的黑客实验;Sora 发布时团队经历"Runway 完了"的至暗时刻,随后三个月将 Gen-3 规模扩大约 10 倍。
- 核心论点:单纯 scale 视频预测模型可能就足以学会物理;实时生成不可避免;直接从物理世界学习可能解锁语言无法覆盖的能力。
- Interface World Models:神经网络直接渲染软件界面像素,无需 HTML/CSS/React,终极形态是纯神经操作系统。
- 机器人方向:世界模型作为机器人模拟器;第三人称互联网视频可能成为机器人智能最大的训练数据源;World Action Models 将视频模型转化为机器人策略。
- 提出"清醒梦测试"(Lucid Dream Test)作为世界模型足够好的判断标准;认为编排(orchestration)最终会内化进模型本身;还谈及开源世界模型、中国视频模型与全球生成式视频竞赛。
所属事件:Runway 联创:视频生成只是起点,目标是世界模拟(2 条相关)→
「具身」频道最新
- 软体气动执行器改用 TPU-硅胶混合结构,行程提升 4 倍 — IanPritchard · 2026-09-25
- Waymo:2.71 亿英里无人驾驶,致伤事故比人类司机少 82% — reed · 2026-09-25
- HRI 2027 新设存档级工业白论文赛道,征集机器人落地实践 — petitegeek · 2026-09-25
- 高通 2nm 骁龙8至尊版发布:CPU 首破 5GHz,全线为智能体重写架构 — 量子位 · 2026-09-25
- Google 员工设想:用智能眼镜实时看见并「拍肩指挥」AI Agent — jason_mayes · 2026-09-25
- 用 iPhone LiDAR 做攀岩 3D 分析:开源视觉工具链解读 — dosco · 2026-09-25