MemTrapBench 评估 LLM 记忆中的认知陷阱

zjunlp · hf · 2026-08-21

MemTrapBench 是一个基准测试,用于评估大型语言模型在使用记忆时可能出现的认知陷阱。研究发现检索到的记忆会诱导推理错误和信念扭曲,同时提出了一种推理时策略,能在保持基准性能的同时帮助避免这些陷阱。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →