Claude 和 Codex 跑了 48 小时,最后卡在随机性阈值
NYCounihan · x · 2026-07-25
作者说,他让 Claude 和 Codex 一起跑了 48 小时,做的只是一个简单的工作流自动化任务。
结果现在卡住的点,居然变成了:同一个 prompt 的模型输出随机性,到底要接受到什么程度。这条很典型地展示了 agent loop 一旦跑起来,最终会把问题推进到流程设计与稳定性治理。
「编程与Agent」频道最新
- 从监督学习到 agentic world modeling 的完整路线图 — cwolferesearch · 2026-07-25
- 让 AI agents 写大部分代码时,如何避免发出烂活 — PuzzleheadedMenu2454 · 2026-07-25
- HarnessRouter 推出单 API 接入应用的 AI Agent 后端 — ycombinator · 2026-07-25
- 作者公开如何用 Claude Opus 5 搭建 AI 研究引擎 — eptwts · 2026-07-25
- OpenHands 社区更新:加入 Kimi Code 支持与自托管修复 — rajistics · 2026-07-25
- OpenHands SDK 1.37.1 支持会话中动态追加 MCP 工具 — rajistics · 2026-07-25