DeepMind:视频生成器或含世界模型
The Decoder · rss · 2026-07-19
The Decoder 转述了 Google DeepMind 关于 GenCeption 的研究观点:他们认为,视频生成器里已经包含了计算机视觉长期缺失的某种“世界模型”能力。
这项工作把一个视频生成器改造用于经典视觉任务,例如:
- 深度估计
- 语义分割
文章称,该模型几乎完全用合成视频训练,却在结果上接近 SOTA,且所需训练数据更少。这个结果也重新引发了一个问题:视频生成模型是否真的已经内含通用的世界模型。
「研究」频道最新
- Tabul AI 推出 Metal TreeSHAP,加速 Apple silicon 上的 Shapley 计算 — Scobleizer · 2026-07-22
- Reddit 转发 OpenAI 的 ChatGPT 广告页面 — EcstaticAsparagus509 · 2026-07-22
- 开源 runtime 让每个仓库自定义 AI 代码审查器 — ibabufrik · 2026-07-22
- Claude 辅助写成的 Rust 太空经济模拟器,能跑数百艘自治船只 — kalcode · 2026-07-22
- OpenAI 与 Apollo 推出 Contrastive SDF 量化奖赏投机 — OpenAI · 2026-07-22
- NVIDIA:先调好 Harness,再去调模型 — NVIDIAAI · 2026-07-22