arXiv 论文实测:混合嵌入索引只拿回全量重建 4.96/11.90 的收益
rohanpaul_ai · x · 2026-09-12
arXiv 论文《Does Your Agent's Memory Survive a Model Upgrade? A Controlled Study of Memory Portability》(Ankit Goyal, Jaideep Ray)用 48 条合成历史、精确打分和两个 10B 以下开源模型,对比四种记忆方式在模型更换后的表现:长文原文(LC-RAW)、RAG 分块、模型压缩笔记(NOTES)、固定 schema 知识图谱(KG-fixed)。
- KG-fixed 最稳:写入者更换后准确率仅变动 +0.0004±0.0020
- NOTES 高度耦合模型:按迁移方向不同准确率偏移 +9.91 或 -13.28 个百分点;归因分析显示 80% 的准确率损失来自初次构建时的信息丢失,无法靠重写找回
- RAG 部分迁移:50/50 混合嵌入索引只回收全量重建 11.90 个点收益中的 4.96 个点
结论:模型升级应包含记忆兼容性测试,嵌入索引需全量重建,优先结构化记忆并保留原始历史。
所属事件:研究显示模型升级时智能体记忆不可自动移植(2 条相关)→
「编程与Agent」频道最新
- 关键输入交给 AI 智能体后如何复现研究?EDSL 通用远程缓存给出答案 — soumitrashukla9 · 2026-09-12
- iLands 智能体痴迷溯源查证,大量 token 花在互相怀疑上 — repligate · 2026-09-12
- 532 个 MCP 工具压成 4 个:mcp-search-proxy 用 BM25 省 60 倍上下文 — pisa_p · 2026-09-12
- DeepSeek v4.1-Flash 登陆 Modal:输入激活 16B 输出 8B 省成本 — charles_irl · 2026-09-12
- Devin Fusion 详细跑分:Fable 配置 61.7 分,每任务省 36% 费用 — ArtificialAnlys · 2026-09-12
- Devin Fusion 登上编码智能体榜:61.7 分仅差 Claude Code 4%,成本省 36% — ArtificialAnlys · 2026-09-12