「澄清即监督」入选 NeurIPS Oral,多模态协作训练新思路
iatitov · x · 2026-10-02
论文《Clarification as Supervision》被 NeurIPS 2026 接收为 Oral(录取率约前 0.3%)。
- 核心问题:当纯文本推理器基于 VLM 生成的 caption 回答却出错时,通常归咎于推理,但实际上往往是 caption 缺失了推理所需的关键细节。
- 方法思路:让模型在训练中充分交互,同时施压促使其减少这种交互,从而获得更密集的学习信号,最终实现更高效的一次性协作。
「研究」频道最新
- Gumbel Straight Flow:把自回归模型蒸馏成单步流映射并行采样 — sedielem · 2026-10-02
- 假说:人类学习也是爬山算法,难验证任务对 AI 并非相对更难 — Afinetheorem · 2026-10-02
- Google 新一代联邦学习:TEE 实现可验证差分隐私并提速训练 — gaganghotra_ · 2026-10-02
- 印度裔科学家 Anima Anandkumar 谈让 AI 理解物理 — nordicinst · 2026-10-02
- 量子优化 25 分钟解决药物发现难题,经典求解器 3 小时仍差 40% — MJBiercuk · 2026-10-02
- AI2 开源 AstaBrief 8B:研究问题一键生成带引用报告 — allen_ai · 2026-10-02