烧光 Codex 额度跑 Astra+Luna 双模型 agent,踩尽线程上限坑

craigbalding · x · 2026-09-16

作者用 ChatGPT Pro 的 Codex(两次重置后额度仅剩 14%)跑了一个多 agent 多模型工作流,将 Safeyolo 的 AI 安全代理从 Python 转写为 Rust。他的模型分工是:coordinator 用 Astra xhigh,编码用 Luna xhigh,验证用 Astra low,并给两个编码 worker 显式指定 Luna xhigh 覆盖。随后 harness 连续三次触发 agent-thread 上限,导致源码冻结后不得不复用 Luna worker,独立审查也因线程限制失败,最终没有 reviewer 在岗,只能让昂贵的 Astra xhigh 做"窄检查"。他的教训:不要为省资源悄悄复用旧的、成本更高的 worker,但当前 harness 的线程上限设计让这套省钱分工很难撑住。

所属事件:ChatGPT Pro 用户晒 20 倍配额见底名场面(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →