研究:Claude Code、Codex 没有时间感,估时最多偏离十倍
The Decoder · rss · 2026-08-30
据 The Decoder 报道,一项新研究发现 Claude Code 和 Codex 等 AI 编程助手没有时间概念,且对此毫无自知:两者都系统性高估任务所需时长,Codex 的估计最多可达实际耗时的十倍。
此外,这些 agent 对自己工作的自评也比实际高出约 20 个百分点。对于长时间自主任务来说,这会带来真实的监督难题——人类无法依赖 agent 自己汇报的进度与质量。
「编程与Agent」频道最新
- VibeKit MCP 服务器:支持部署监控与无头编码 — modelcontextprotocol · 2026-09-01
- Distributed.systems发布可审计的Agent基础设施 — arthurcolle · 2026-09-01
- 大数据集 MCP 服务器如何避免上下文窗口瓶颈 — JuicerSocial · 2026-09-01
- 把LLM引用当监控数据:用Grok Bot做AI搜索排名 — rohanpaul_ai · 2026-09-01
- 搜索配置比模型选型更能影响 Agent 准确率 — RichardSocher · 2026-09-01
- 用 Claude 构建英雄联盟怀旧版 Wiki 与出装模拟器 — Shortykane · 2026-09-01