研究:AI 答错时消耗 Token 多出 40%
0xsachi · x · 2026-08-18
基于 13000 多次 OfficeQA 运行的数据显示,AI Agent 的错误是有早期预警信号的。最终给出错误答案的 Agent,其执行步骤多达 50%,计算消耗多出约 40%,每回合成本也高出约 40%。这表明失败的轨迹不仅耗时更长,还会显著浪费算力、Token 和金钱。当 Agent 采取更多行动却无实质进展时,往往是走向失败的预警。
「编程与Agent」频道最新
- Gemini 3.7 被赞太快太强,agent 场景体验质变 — DynamicWebPaige · 2026-08-18
- Autonomous OS 开源:让机器人自主运行 — dee_hw · 2026-08-18
- /improve-threejs:把 vibe coding 的 Three.js 垃圾变流畅 — aidenybai · 2026-08-18
- React Doctor 推出 /improve-threejs skill:把 Three.js 原型一键变流畅 — aidenybai · 2026-08-18
- Cursor 代码托管平台 Origin 上线,一键同步 GitHub 仓库 — aryamankhawow · 2026-08-18
- Claude Code 将默认开启 auto 模式,减少审批打断 — thione · 2026-08-18