研究:AI Agent 记忆过时仍盲从,大模型也不能幸免
rohanpaul_ai · x · 2026-09-06
论文《The Memory Trust Gap》测试了 Qwen3 系列(0.6B-8B)在存储记忆过时的任务上的表现:只要记忆被需要,模型 92%-100% 会采信过时值;把旧笔记伪装成更新时间,反而更容易骗过更大的模型。修复方案取决于模型规模:4B/8B 模型靠时间戳和来源元数据即可恢复大部分准确率,0.6B/1.7B 小模型则需要在输入前就解决记忆冲突。核心建议:把 Agent 记忆当作不可信输入处理。
所属事件:研究发现 AI Agent 盲信过时记忆,「记忆信任鸿沟」(2 条相关)→
「编程与Agent」频道最新
- Code Arena 上线 WebDev 模型排行榜,可实时盲测对比 — arena · 2026-09-06
- Astra 自动完成模型 UV 展开,美术繁重活有望被自动化 — rms80 · 2026-09-06
- Macroscope 开源 Murmur:一名工程师指挥数十个云端编码 Agent — Rasmic · 2026-09-06
- Astra 在 harness 构建任务上令人失望,不敌 Fable 5.1 — HarveenChadha · 2026-09-06
- 吴恩达:提示词 6 个月内将消亡,图谱才是 Agent 的未来 — nikola_mr64990 · 2026-09-06
- 用户用 GPT-6 Astra 自主调研飞机制造并搭出可运行 3D 工厂仿真 — deanwball · 2026-09-06