SECRET 免训练法缓解音视频大模型跨模态幻觉,最高提升 18 个百分点

Yu Zhang · hf · 2026-10-02

论文针对音视频大语言模型(AVLLM)的「来源混淆 grounding 幻觉」:未被使用的模态线索会诱导模型给出所需模态不支持的回答。

关键发现

方法:SECRET

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →