GenCeption:视频模型做视觉任务

dimadamen · x · 2026-07-13

Google DeepMind 介绍了 GenCeption:一个用于多种视觉任务的前馈视频模型。

这条转发重点强调了几个结论:

帖子原文把它类比成“视频生成模型之于视觉,是否会像 LLM 之于语言”这样的方向性问题。

所属事件:GenCeption:视频生成模型即通用视觉学习器(6 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →