Codex+本地 agent 省 80% token

KitchenAmoeba4438 · reddit · 2026-07-19

作者分享自己把 Codex 5.6 与本地或低价 agent 结合后的实测结果,目标是让主模型负责“指挥”,而把实际执行交给更便宜的 agent。 他给出三组基准结果,显示管理端 token 和成本都显著下降:在 SWE-bench Lite、reddit10 子集和 SWE-bench Verified 多文件任务上,token 降幅大约在 58% 到 87% 之间,成本下降约 46% 到 72%。作者还提到,这种方案已经让他能把主模型的 effort 开得更高,从而在更低成本下拿到更好的结果;目前初步看速度也有提升,但更大的收益还是 token 节省。 他的“秘诀”不是 orchestration 本身,而是 memory:让 agent 之间能跨轮沟通,并确保同一件工作只做一次,否则 naive 编排会导致重复劳动。帖子里还附了 GitHub PR、代码和原始数据,方便复现和审阅。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →