5 个开源工具让 Claude 和 Codex 智能体少用 60% 到 95% token
CodeByPoonam · x · 2026-07-29
这条帖子整理了 5 个能降低编码智能体 token 消耗的开源项目,面向 Claude、Codex 这类按 token 计费的场景。
- headroom:先压缩工具输出、日志和文件再喂给模型,声称可减少 60%–95% 的 token,用法包括库、代理和 MCP server。
- graphify:把代码库和文档变成可查询知识图谱,让 agent 按需取上下文,而不是一次性装满上下文窗口。
- ponytail:让 agent 倾向更“懒”的资深工程师风格,少做过度设计、少写代码。
- caveman:去掉模型输出里的客套、铺垫和模糊语气,直接给答案。
- rtk:裁剪 tool-call 流,让每一步推理和调用更省 token。
「编程与Agent」频道最新
- Tagvico 3.2.5 直接验证模型能否完成应用所需工具调用 — its_artur1 · 2026-07-29
- Caveman 让 AI 编程回复更省 token,还保留技术细节 — KhuyenTran16 · 2026-07-29
- 微服务目录实测:Markdown、GraphRAG、MCP 图工具各有不同失效模式 — JeremyCMorgan · 2026-07-29
- Composio 评测显示编程 harness 成功率接近,但速度差距很大 — Teknium · 2026-07-29
- LLM API 的输出 token 上限参数名还没统一 — nuno6Varnish · 2026-07-29
- 开源面板并排比较 x402 与 MPP 的交易、成交额和用户数据 — kleffew94 · 2026-07-29