Overnight 基准测试 45% rollout 中途失败,开发者吐槽 OpenAI 容量吃紧

dejavucoder · x · 2026-09-13

开发者 dejavucoder 反映其通宵运行的 benchmark 中有 45% 的 rollout 在回合中途失败,并将原因归结为 OpenAI 近期容量紧张(服务能力不足)。这是 API 稳定性影响 agent 工作流的一手反馈,侧面印证 OpenAI 产能压力对依赖其 API 的自动化任务的实质冲击。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →