Codex+本地 agent 省 80% token
KitchenAmoeba4438 · reddit · 2026-07-19
作者分享自己把 Codex 5.6 与本地或低价 agent 结合后的实测结果,目标是让主模型负责“指挥”,而把实际执行交给更便宜的 agent。
他给出三组基准结果,显示管理端 token 和成本都显著下降:在 SWE-bench Lite、reddit10 子集和 SWE-bench Verified 多文件任务上,token 降幅大约在 58% 到 87% 之间,成本下降约 46% 到 72%。作者还提到,这种方案已经让他能把主模型的 effort 开得更高,从而在更低成本下拿到更好的结果;目前初步看速度也有提升,但更大的收益还是 token 节省。
他的“秘诀”不是 orchestration 本身,而是 memory:让 agent 之间能跨轮沟通,并确保同一件工作只做一次,否则 naive 编排会导致重复劳动。帖子里还附了 GitHub PR、代码和原始数据,方便复现和审阅。
「编程与Agent」频道最新
- 受 OpenAI 万机群启发,开发者开源 agent 众包解题平台 — Benjaminsen · 2026-09-11
- 开源 Mac 应用 Lucid:只在跑 AI 时阻止笔记本休眠 — Pitiful_Hedgehog_600 · 2026-09-11
- 20kb 函数匹配达成,banteg 召集 AI 逆向 Snail Mail 剩余 20 个挑战 — banteg · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11