ReactVAU 登场 ECCV 2026:快慢双通路让流式视频理解少唤醒大模型
CMHungSteven · x · 2026-09-10
团队将在 ECCV 2026(瑞典马尔默)展示 ReactVAU,一种面向流式视频理解的因果(causal)框架,核心是不让 VAU「偷看未来」,也不必每一秒都唤醒重型多模态大模型。
设计要点:
- 一个常开的轻量快速检测器负责逐帧监控;
- 持久记忆用于捕捉稀有线索;
- 只有当视频流看起来可疑时才触发慢速的大模型推理。
在因果协议下取得有竞争力的检测与描述成绩,同时大幅减少 MLLM 调用次数。论文、代码、模型与演示页面均已公开,作者来自 NVIDIA 与台湾清华的团队合作,海报时间为 9 月 10 日 16:30–18:30 CEST。
所属事件:NVIDIA 等推出 ReactVAU:快慢双通路省下流式视频理解算力(3 条相关)→
「研究」频道最新
- CoT 相似度检测显示 Qwen3.8 疑似用 GPT 5.5 思维链训练 — Chromix_ · 2026-09-10
- Bristol and MPI release EPIC-Contact dataset and HOPformer, first-person 3D hand-object pose estimation — Michael_J_Black · 2026-09-10
- 研究:24% 的 AI 科研文档被判定为改写式抄袭 — danish037 · 2026-09-10
- 告诉agent预算有100万token,它竟多思考3-5倍 — paraschopra · 2026-09-10
- Meta Boxer 亮相 ECCV:应对 3D 真值数据与 2D 差距扩大 — ducha_aiki · 2026-09-10
- TRL 发布百万 token 长上下文训练指南,单节点训通 Qwen3-8B — QGallouedec · 2026-09-10