arXiv 论文「记忆信任鸿沟」:Agent 记忆过信任随模型规模变化

rohanpaul_ai · x · 2026-09-06

arXiv 论文 2609.01852《The Memory Trust Gap》系统研究了持久记忆 Agent 对过时记忆的过度信任如何随模型能力变化。论文在 Qwen3 0.6/1.7/4/8B 同系列模型上用双套件基准测试:Benefit 套件(必须有记忆才能答对)中,所有规模的模型 92%-100% 采信过时值,说明这是过度信任而非混淆;Safety 套件(权威工具始终持有正确值)中的伤害是能力门控的,大模型在旧笔记被伪装成新笔记时崩溃最严重。

关键发现:

结论:Agent 记忆应被视为不可信输入,缓解策略需按模型能力分级设计。

所属事件:研究发现 AI Agent 盲信过时记忆,「记忆信任鸿沟」(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →