ACTx486 演示「可以对话的任意视频」,实时生成图表还能推送到手机
karinanguyen · x · 2026-09-24
研究 demo ACTx486 提出一种新交互媒介:把已有视频(演示中为播客)变成可以实时对话的对象,观众可提问、打断、追问,甚至进入新场景。
- 主打「不从空白聊天框开始」:以现有内容提供叙事、节奏与上下文,用户通过视觉化对话塑造体验,成为「微导演」
- 能实时逐笔生成示意图配合主持人的讲解
- 系统持有观众画像,回答按个人兴趣与情境个性化,有价值的信息以卡片形式推送到手机
- 演示中 AI 版 Elon 式主持人可根据对话者行程给出 LA 推荐并直发手机
- 原始对话保持原样同步播放,新增内容叠进新世界,结束后回到演播室
所属事件:ACTx486 演示可与视频实时对话的新交互媒介(4 条相关)→
「多模态」频道最新
- arXiv 论文揭秘:RoPE 空间偏置导致视频扩散模型违反物理规律 — udmrzn · 2026-09-24
- 用 Codex 驱动 Dreamina CLI 自动搭 AI 视频工作流,迭代不再重跑全片 — HeyNayeem · 2026-09-24
- Kling 视频 API 开源 Python SDK 上线,实调 Kling 3.0 接口 — matchaman11 · 2026-09-24
- Seedance 2.5 稳坐 AI 视频王座,Kling 4 蓄势挑战 — matchaman11 · 2026-09-24
- Polyfork:每个 3D 资产是一段程序,Agent 写代码造模型已变现 — PeterDiamandis · 2026-09-24
- 字节 Dreamina 网页版全新上线:Canvas 创作流 + 影视级工作流 — alifcoder · 2026-09-24