要求审计 Codex 会话,找出长跑中的重复失败模式
kevinkern · x · 2026-07-28
一条面向 Codex 的分析提示词,要求它检查过去两周的 /.codex/sessions,重点找出长会话中的重复失败模式:何时被打断、纠正、重复下指令、拒绝成果、阻止跑偏、修复回归、重新指路等。
回复里点出一个常见问题:Codex 有时会把 sandbox 限制误判成 bug,接着编出一个“创造性 workaround”,反而直接把流程带向另一个失败点。作者认为这类归纳有助于改进后续工作流。
所属事件:复盘Codex长会话暴露AI智能体连锁失误(2 条相关)→
「编程与Agent」频道最新
- 系列第三篇用 SlopCodeBench 评测 Opus 5 软件工厂 — teropa · 2026-07-28
- 这个提示词的关键,是子代理盲测 A/B 评审 — mattshumer_ · 2026-07-28
- 单个提示词配 Opus 5 生成了一个 Three.js 游戏 — majidmanzarpour · 2026-07-28
- 智能体正在让单用户专用应用变得可行 — cnakazawa · 2026-07-28
- 智能体让一个人也能做出专属工作流应用 — cnakazawa · 2026-07-28
- Squarespace:用 AI 先“弄脏页面”再做原型 — rseroter · 2026-07-28