ECCV 2026 教程:统一框架贯通 LLM 幻觉检测与对抗防御
abursuc · x · 2026-09-09
AMIAD & ENSTA Paris、Safran Tech、valeo.ai 与新加坡国立大学的研究者将在 ECCV 2026 举办半日教程《From Hallucination Detection to Adversarial Defense: A Unified Framework for LVLM and LLM Safety》(9 月 9 日上午),幻灯片、代码、notebook 与录像将全部公开。
教程核心是把可信大模型的三条研究线统一起来:
- 幻觉检测:区分内在/外在、视觉、事实与推理类错误;
- 不确定性量化:指出仅靠 token 概率不够,比较 token、序列与语义三层不确定性度量;
- 对抗防御:梳理提示词、视觉输入、上下文窗口、RAG 检索链与微调数据等攻击面,评估 grounding、验证、拒答、鲁棒对齐与对抗训练等防御手段。
定位对新手友好,同时覆盖最新研究方向、评测工具与开放问题。
「安全」频道最新
- USC 研究:LLM 知道问题无法回答,却因安全通路错位不拒答 — UniversityofSouthernCalifornia · 2026-09-09
- 美议员引 WSJ 报道推动两党 AI「Kill Switch」法案 — austinc3301 · 2026-09-09
- 美参议院委员会四个月零 AI 听证,议程竟是大学体育法案 — austinc3301 · 2026-09-09
- 网友质疑 Meta AI:号称私密安全,却记录并可审查全部聊天 — anshulkundaje · 2026-09-09
- 新加坡发布全球首个 AI Agent 治理框架,四大维度划定责任 — Comfortable_Gene5180 · 2026-09-09
- 网友称发现绕过 Codex 子代理提示词加密的方法 — Aryvyo · 2026-09-09