GenCeption:视频模型做视觉任务
dimadamen · x · 2026-07-13
Google DeepMind 介绍了 GenCeption:一个用于多种视觉任务的前馈视频模型。
这条转发重点强调了几个结论:
- 模型在相关任务上达到 SOTA
- 训练/使用方式更数据高效
- 还观察到一些涌现行为
- 相关工作将发布于 ECCV 2026
帖子原文把它类比成“视频生成模型之于视觉,是否会像 LLM 之于语言”这样的方向性问题。
所属事件:GenCeption:视频生成模型即通用视觉学习器(6 条相关)→
「多模态」频道最新
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- 3D 网站生成工作流公开:MCP 接 Codex,一句话出可玩游戏 — FellMentKE · 2026-09-11
- 用 GPT-6 Astra 加 Hyper3D MCP 免建模做 3D 落地页 — FellMentKE · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11