fast-jev-compaction:1 秒把 Claude 会话从 100 万 token 压到 8.6 万
viksit · x · 2026-09-18
开源项目 fast-jev-compaction 提供了一种无损式的上下文压缩替代方案:不做 LLM 摘要,而是用 Jev 模型在单次快速请求中对每条工具调用与结果打分,删除或截断已过时的部分,保留内容原样不动,用户与助手文本保持原顺序逐字保留。
- 动机:传统 compaction 用 LLM 摘要旧对话是有损的,文件路径、报错、约束、命令等关键信息可能丢失
- 效果:实测一次运行约 1 秒,把近 100 万 token 的 Claude 会话压到约 8.6 万 token
- 形态:Claude Code 插件,也可作为 npm 库使用,GitHub 已有 600+ star
作者建议直接让 Claude 安装配置即可使用。
「编程与Agent」频道最新
- 初级后端开发者困惑:RAG、向量库和Agent该现在学吗 — Effective_Emphasis21 · 2026-09-18
- WebMCP 获开发者圈好评:让浏览器成为 MCP 客户端 — nickbaumann_ · 2026-09-18
- Claude 内置 Cowork + Artifacts:一句话生成多人游戏 — felixrieseberg · 2026-09-18
- 六大编码 Agent 的 Plan Mode 同构,批准后上下文处理却各不相同 — RunAI_Coder · 2026-09-18
- EvoSkill-GUI 免训练技能自进化,GUI Agent 基准最高提升 16.2% — Bofan Chen · 2026-09-18
- LLM 每次生成不同的 Agent 流水线,属性断言成测试新思路 — Repulsive_Sugar_5252 · 2026-09-18