统一定义大模型幻觉
机器之心 · wechat · 2026-07-19
这篇文章介绍了一篇关于“大模型幻觉统一定义”的 ICML 2026 position paper,以及配套基准 HalluWorld。
核心观点是:不同任务里“幻觉”对应的参考世界并不一样,摘要看的是源文档忠实性,开放域问答看事实性,RAG 和 Agent 还要显式考虑检索文档、参数记忆、环境状态与冲突策略。作者因此把幻觉形式化为:在指定参考世界模型、视图函数和冲突策略下,模型输出中某个可观察命题为 false。
文章进一步强调,很多错误不应都叫幻觉:规划错误、拒答、指令跟随失败都应与幻觉区分。基于这一框架,HalluWorld 构建了三类环境:GridWorlds、Chess 和 TerminalTasks,用规则式判定代替 LLM 裁判。实验显示,前沿模型在静态可见信息上接近饱和,但在多步状态维护、因果模拟和“不确定时应说不知道”方面仍明显薄弱。
「研究」频道最新
- Nature 新研究实现全身器官细胞活动成像,揭示跨器官体级回路 — arjunrajlab · 2026-09-11
- SignNet 1M 手语数据集发布 — ducha_aiki · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- InFlux++ 方法发布 — ducha_aiki · 2026-09-11
- Skyfall GS 登场:用 Flux 提升 Gaussian Splatting 精修质量 — ducha_aiki · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11