156k 上下文秒砍到 62k:Jev 逐条给工具调用打 KEEP/DROP
Moretti_a · reddit · 2026-09-18
编码 agent 常死于 150k token 的 Read/Bash/Edit/重试历史。传统压缩靠模型自我总结,是「有损」的:精确路径、报错字符串、关键约束容易丢失。新方法用 TypeSafe 的 Jev 对每条工具调用打 KEEP/DROP 分,删除低分项,用户/助手文本原样保留,demo 几秒内把 156k 上下文压到 62k,仓库为 tamaratran/fast-jev-compaction。
但作者列出几个坑:
- 删掉失败尝试,模型可能不知道自己试过这条路,导致重试循环
- 中途删除历史会打爆 KV cache,算力成本可能反超保留噪声
- 前沿模型隐藏推理轨迹,砍历史可能让 Claude Code 变笨而非变省
结论:这不是「解决了记忆问题」,而是一个跑在历史上的快速分类器,不是压缩器。作者询问有没有人跑过 20–30 次工具调用以上,模型是否还记得自己试过什么。
「编程与Agent」频道最新
- Agent 项目烂尾后还剩什么:隐性知识散落在提示词与配置里 — Mariav_Dowdf · 2026-09-18
- PCP 草案:给 AI Agent 立规矩的「有边界的授权协议」 — sierracatalina · 2026-09-18
- Legatus v0.1 开源:面向委派工作的传输无关协调协议 — sierracatalina · 2026-09-18
- Salesforce 推出 Trusted Enterprise AI Harness,统一 agent 上下文与安全治理 — emmanuelvivier · 2026-09-18
- microvm+gVisor 沙箱跑 codex/claude,agent 拥 root 仍安全可控 — craigbalding · 2026-09-18
- LLM 评测复现工具 EvalSeal:LLM 裁判 20 例中 5 例翻转 — Fit_Fortune953 · 2026-09-18