MemTrapBench 评估 LLM 记忆中的认知陷阱
zjunlp · hf · 2026-08-21
MemTrapBench 是一个基准测试,用于评估大型语言模型在使用记忆时可能出现的认知陷阱。研究发现检索到的记忆会诱导推理错误和信念扭曲,同时提出了一种推理时策略,能在保持基准性能的同时帮助避免这些陷阱。
「研究」频道最新
- Nature 研究:AI 抗体生成面临泛化难题 — anshulkundaje · 2026-08-21
- 基于信息论的新型降维方法:Entropic Scree — Chocolate_Milk_Son · 2026-08-21
- 语义缓存实测:重写劣质缓存不如直接丢弃 — Reasonable_Royal_621 · 2026-08-21
- 统计模拟难做?Ian Arawjo发推吐槽 — IanArawjo · 2026-08-21
- 教你自制遇光变蓝的光致变色系统 — johnowhitaker · 2026-08-21
- Kaggle 推出对抗性客户服务基准,测模型防欺诈能力 — MeganRisdal · 2026-08-21