61 天实测:Hook 显示成功,Claude Code 上下文实际只送达 11%
JhouHate · reddit · 2026-09-30
作者独自运营多个项目、常开多个 Claude Code 会话,在两个月里构建了一套名为 Hipocampo 的原生功能组合(hook、MEMORY.md、CLAUDE.md、skills、subagents、compaction,不装任何东西、不用 MCP),并测量什么内容真正进入了模型的上下文窗口。他提出三态模型:
- Resident:每次会话必达(首决策前由 hook 加载的地图、记忆索引、状态文件);
- Paged:仅在被打开时才进入(子目录 CLAUDE.md、文档、记忆文件);
- Interrupt:仅在与注册源匹配的事件触发时进入。
关键测量结果(190 个主会话、918 个 subagent 文件、61 天 transcripts):
- 190 个对话中 0 次「注入式回忆」,记忆只在 agent 主动打开文件时进入;432 条记忆中 209 条至少被打开一次;
- Compaction 非常激进:8 月一次事件删除了 96.6% 的上下文(607,378 → 20,766 tokens),36 条消息里 8 条在摘要中毫无痕迹;
- 8 月 13 日,加载项目地图的 hook 发出 18,057 字节,但只有约 11% 到达模型——runtime 显示成功、脚本日志显示完成、自测 9/9 通过,唯一能抓住问题的是逐字节比对脚本输出与 transcript 记录。原因是 hook 输出超过 10,000 单位会被写入文件,只有约 2 KB 预览送达模型;此后地图被切成 5 片,每片低于上限;
- 9 月 21 日起,65 次 compaction 中 64 次发生在 365K tokens 及以下(此前接近 1M);
- 守卫(guard)必须先故意植入缺陷并拒绝才算数:9 月 25 日,74 个守卫中 52 个有此证明,其余计为技术债。
文末给出 7 步搭建顺序,每步注明依赖的原生功能和证明其生效的「红灯」验证,并主张每一步都故意破坏组件来验证会失败。局限:单操作者、单安装,未验证送达的记忆是否正确或有用。
「编程与Agent」频道最新
- 前 Google 工程师详解:TensorFlow 进入维护模式后如何迁移 — lmoroney · 2026-09-30
- Google 前开发者关系负责人确认:TensorFlow 已处维护模式 — lmoroney · 2026-09-30
- 用 LLM 逆向 SNES 游戏:作者称编码模型逆向能力狂飙 — gandamu_ml · 2026-09-30
- 用 Rust 自写静态类型语言 Lumen:下一步加带数据的 enum 与 match — Abhishekcur · 2026-09-30
- 用 Claude 生成 Remotion 视频:挑战真实产品 UI 展示 — EagleApprehensive · 2026-09-30
- 10 天把 SNES 马车搬进 Minecraft,连 AI 对手都逆向移植了 — gandamu_ml · 2026-09-30