删除68%记忆后效果反而更好?Memory工程实测
AccBalanced · x · 2026-08-23
- 核心发现:一开发者发现删除 Claude 68% 的记忆文件后,回答质量反而提升。他并未手动猜测删除内容,而是构建了一套自动化评估流程。
- 测试方法:选取 40 个真实历史提示词,进行 4160 次对比测试,成本仅 1.4 美元。让 OpenAI 模型作为裁判逐行评估记忆条目对回答的影响。
- 关键结论:71 条记忆(占比 68%)从未改变过任何回答结果,属于纯粹的无效负载。必须通过“外部审计”而非自我评分来清理记忆,因为模型倾向于维护自己生成的内容。
- 记忆管理启示:像“喜欢简洁回答”这种泛泛而谈的偏好被证明无效;而具体的项目事实(如“周四上线”、“3月否决了队列方案”)则被保留。Memory 工程的核心不是防止遗忘,而是防止记忆污染。
「编程与Agent」频道最新
- Together 实测:GLM-5.3 四次尝试在 DeepSWE 上胜 Fable 5 且更省 — togethercompute · 2026-08-23
- 用 openclaw 连 Spotify:一句话描述氛围就能生成歌单 — steipete · 2026-08-23
- Agent 技能共享难题:插件机制 vs 单机模式 — blelbach · 2026-08-23
- 开源 Steam MCP 服务器:让 AI 调取游戏数据 — rachittshah · 2026-08-23
- OpenSlide 框架:让编码智能体用 React 生成自然语言幻灯片 — tom_doerr · 2026-08-23
- ComfyUI-Autograph:支持 REPL 补全的 Python 工作流驱动库 — Jumpy-Measurement-65 · 2026-08-23