5周A/B实测:OptMem对比Claude Code原生记忆,略优但腐化更隐蔽
_rchaves_ · x · 2026-09-14
LangWatch 开发者用 @VictorTaelin 的 OptMem 替换 Claude Code 原生记忆 5 周,并利用部分会话中 OptMem 未被随机激活的机会做了一次天然 A/B 对比(对照前 3 个月的原生记忆数据)。
核心结论:
- OptMem 比原生记忆更好,但优势不大,且体现在不同维度
- 记忆对 agent 确有帮助,主要在长会话中
- 最大价值是避免「重复发现」和浪费时间的「陷阱」型错误
- token 成本节省有限
- 作者选择继续使用 OptMem
OptMem 的关键设计是保持记忆固定大小:结构化、人类可读,不像随机 markdown 或压缩向量库;且天然限制了记忆腐化的「伤害半径」。作者引用 Claude 自己的分析:原生记忆通过原地重写修正(2,081 次写入中 1,719 次是重写,MEMORY.md 被重写 601 次),但腐化表现为世界变化后的静默过期(39% 路径 token 过期、260 个文件中 68 个掉出索引);OptMem 只能追加不能重写,腐化表现为矛盾与压缩(281 行中仅 3 条显式修正、5 对无标记的矛盾记录)。有趣的是,尽管如此 OptMem 累积的误导性记忆反而更少。
「编程与Agent」频道最新
- chrome-mcp 驱动真实 Chrome 填 30 字段表单,148 步全程可审计 — SYEDNIICK · 2026-09-14
- 9router + 本地路由兜底,解决 Agent 任务中途被限流打断 — phanue1 · 2026-09-14
- SQLite/S3 加每目录 OPA 脚本:一条适合 AI agent 的文件系统构想 — tobowers · 2026-09-14
- SIEM 工单交给 AI 处理:工作流工具还是纯 Agent? — Melodic_Tooth6885 · 2026-09-14
- Agnes 2.5 Pro Beta 对比 GPT-5.6 Sol:同题 3D 模拟成本 $0.20 vs $1.70 — iamaliveix · 2026-09-14
- 给本地 Agent 装上眼睛:Qwen2.5-VL 自建监控数据集,数据不出家门 — AIForOver50Plus · 2026-09-14