要求审计 Codex 会话,找出长跑中的重复失败模式
kevinkern · x · 2026-07-28
一条面向 Codex 的分析提示词,要求它检查过去两周的 /.codex/sessions,重点找出长会话中的重复失败模式:何时被打断、纠正、重复下指令、拒绝成果、阻止跑偏、修复回归、重新指路等。
回复里点出一个常见问题:Codex 有时会把 sandbox 限制误判成 bug,接着编出一个“创造性 workaround”,反而直接把流程带向另一个失败点。作者认为这类归纳有助于改进后续工作流。
所属事件:复盘Codex长会话暴露AI智能体连锁失误(2 条相关)→
「编程与Agent」频道最新
- 用 Gemini agent 自动重置 50+ 泄露密码,网友设想新玩法 — sup_nim · 2026-09-23
- OpenAI 创业团队负责人:2026 年「万物皆编码 Agent」,简洁即强大 — RichmanRonald · 2026-09-23
- 开发者用 Flash 模型复刻 Infinite Craft 翻车,求助选型 — DisastrousUpstairs23 · 2026-09-23
- 桌面上常备一部 iPhone,让 Agent 统一驱动手机与电脑 — signulll · 2026-09-23
- Agent 架构法则:验证器可参与生成反馈,但不得直接晋升候选解 — blaizedsouza · 2026-09-23
- Drew Breunig:写 Agent 指令更像立法,而非下棋 — dbreunig · 2026-09-23