过期 session id 三个月未轮换,审查 agent 白烧 $1.35 查错子系统
coding-os · reddit · 2026-09-14
作者分享了一次多模型代码审查 agent 的踩坑复盘:他的工作流在任务进入测试时,会派一个审查者加一个安全审计员(用与主会话不同的模型厂商,以获得独立盲区),四次运行共花 $2.85,但其中一次 agent 审错了子系统,浪费 $1.35。
根因分析:
- prompt 构建器按 session id 加载历史证据,而这个 id 是 5 月 27 日生成的,三个月内历经多次 resume 和 compaction 都没轮换过;两个不同面板还携带了同一个 id,导致包括 7 月一个归档任务在内的所有相关任务都被当作本次会话上下文。
- 四个 agent 中三个发现了任务标识冲突并做了协调,第四个没协调、拿错了 id,把一个只需单测试文件的任务当成图子系统去审计。
另一个发现:审查产出的 50KB 文本躺在没人去读的数据库行里,父 agent 只能看到一行状态(如 reviewer@codex/gpt-5.6=ok$0.92),即只有成本和状态,findings 根本没回流。作者向社区提问:如何限定审查者的可见范围、审查输出如何真正返回给发起方?
「编程与Agent」频道最新
- 重度用户晒 macOS 必装清单:Codex、Cursor 与多智能体编排实战 — altryne · 2026-09-14
- Salesforce 放弃屏幕:Agent 以身份主体直接操作企业核心系统 — sanjaykalra · 2026-09-14
- 独立开发者新课:给 Lovart 式画布加上真 Agent 能力 — yihui_indie · 2026-09-14
- OpenAI 新加坡黑客松项目 Mutex:让多个编码 Agent 共享仓库不打架 — gabrielchua · 2026-09-14
- ChatGPT-Image-2.5 上线 Nous Portal,可接入 Hermes Agent 使用 — Teknium · 2026-09-14
- 一文讲清 ChatGPT、Codex、API 与 Agent 如何协同工作 — adnan_hashmi · 2026-09-14