实验:个人 Agent 记忆超 10 行开始失灵,计数任务改用代码零违规
rohanpaul_ai · x · 2026-10-05
一项关于个人 agent 记忆机制的实测结论:相关笔记有帮助,但超过一定规模后,额外记忆反而让 agent 更容易漏掉规则——记忆规模存在甜点区。
关键发现:
- 规则 vs 代码:风格类偏好(如用名字署名)用书面规则即可;但需要持续计数/追踪的任务(如消费总额),书面规则 44% 的轮次失败,改用代码维护则 0% 失败。
- 记忆甜点:用 Claude Haiku 4.5 测试,无记忆时违规率 77%,10 行记忆降到 20%,记忆再变长反而回升到约 25%。
- 自我改写记忆有上限:让 agent 根据用户抱怨自行重写记忆,早期有效但很快停滞,最好方法也停在约 48% 违规率;而直接把每条偏好明确告知 agent 只有 7.1%。
实践建议:凡是必须精确计数或追踪的事交给代码,记忆保持精简。
「编程与Agent」频道最新
- 同一提示词横评:Claude、ChatGPT 与 Figma Make 谁更强 — Tegadesigns · 2026-10-05
- 开发者用 Agent 把 Muse 语音助手移植到 15 年前的老 PSP 上 — alexandr_wang · 2026-10-05
- MicroFactory 推出 AI 机器人集成器:自动设计夹具、写视觉代码、指挥机器人 — ihorbeaver · 2026-10-05
- Linear 客户周日早上报 Bug,AI Agent 自动修复并开出 PR — jeff_weinstein · 2026-10-05
- 把 AI 记忆做成身份连续性实验:448 条记忆、4606 个链接 — RileyRalmuto · 2026-10-05
- 免费提示词优化重复 Agent 任务,实测省 90% 以上 token — vivekhaldar · 2026-10-05