Meta 研究员谈 SeeTheAGI:目标是实时交互式视频生成
alex_conneau · x · 2026-09-25
Meta 语音/多模态研究员 Alex Conneau 转发 #SeeTheAGI 话题并阐述其研究路线:刚发布的 Avatar 只是起点,更大的目标是实时交互式视频生成——让用户通过语音与 AI 对话,AI 则以日益丰富的视觉世界来表达自己。
他表示这是团队两年前启动的研究旅程,实时视频生成被视为通向更自然交互形态的关键一步。
「多模态」频道最新
- Gemini TTS 发布会现场:可提示词控声,寿司翻译成亮点 demo — jocarrasqueira · 2026-09-25
- HuggingChat ML Intern 一条提示词 75 分钟自动训完 LoRA — Gradio · 2026-09-25
- Gradio 上线 LoRA 视角编辑 Demo,25 秒生成新视图附评测 — Gradio · 2026-09-25
- AI 视频即游戏引擎:PixVerse R2 用单一因果主干实时生成世界 — future_coded · 2026-09-25
- 视频生成加“micro expressions”提示词,角色情绪更细腻 — R34vspec · 2026-09-25
- 用户用 Opus 5.5 为旧素材生成音乐视频,效果获好评 — repligate · 2026-09-25