REDE 通过去噪推理轨迹提升大推理模型幻觉检测
NanyangTechnologicalUniversity · hf · 2026-07-28
REDE 通过清理推理轨迹来提升幻觉检测
这篇论文关注大型推理模型的长推理链:其中常混入无关步骤和重复步骤,会明显干扰幻觉检测。作者指出,这两类噪声都会降低检测性能,而现有的置信度分数和简单 embedding 过滤方法,难以稳定区分噪声与有效推理。
为此,论文提出 REDE:利用最终答案的 attention 作为自动监督信号,去塑造步骤级表示空间,从而识别并过滤噪声步骤。去噪后的推理轨迹可以直接接入不同的幻觉检测器;在多个推理基准上,REDE 都比强基线更稳地提升了检测效果。
所属事件:REDE 提出去噪推理轨迹以检测大模型幻觉(2 条相关)→
「研究」频道最新
- 工程师驳斥Kimi K3内存论:小状态不代表能闪存卸载 — AccBalanced · 2026-07-30
- 讨论:为何没人开发神经网络检测AI文本?图像已有研究 — emeka_boris · 2026-07-30
- Agent做数学研究仍困难:代码生成陷入证书和库存 — doodlestein · 2026-07-30
- TorchSpec 实现大规模分离式推测解码训练,已被腾讯混元等采用 — zhyncs42 · 2026-07-30
- 算力狂飙:2028 年 AI 将解锁的十大科技突破 — Annual_Judge_7272 · 2026-07-30
- 揭秘 SOTA 深度研究架构:模型原生训练与 150 个子智能体 — SimonShaoleiDu · 2026-07-30