研究实测:加算力未必加速 Agent,瓶颈常在 CPU 与等待
alex_verem · x · 2026-09-24
韩国大学与微软亚洲研究院的论文《Not All AI Agents Are Equal》测量了 agent 在三类任务(文档问答、网页搜索、写代码)中的时间与资源分布。
- Agent 分两半:思考在远端 LLM,执行在本地工具容器;瓶颈常在本地而非模型
- 网页搜索 agent 最慢却只用 14% CPU——近一半时间在等网站响应;文档问答 agent 花 62% 时间搜本地库,CPU 均值 86%
- 2 核升 8 核:问答 agent 快 13 倍,搜索 agent 仅快 4%——同一升级对不同 agent 效果天差地别
- 限制并发工具数让问答 agent 快 3.2 倍,却让编码 agent 慢 2.8 倍
- 最优方案不加硬件:按任务重新分配 6 核并差异化限流,平均响应时间降 32%,问答 agent 快 5.4 倍
结论:慢 agent 未必需要更大模型或更多算力,先搞清楚它在等什么。
「编程与Agent」频道最新
- 神秘新模型 Space Bunny 免费一周:单 prompt 生成完整 60fps 游戏 — iamfakhrealam · 2026-09-24
- Depthfirst 用 agent 追踪依赖可达性,召回与精度大幅超越传统方案 — andreamichi · 2026-09-24
- 开发者发布免配置 GSC MCP 服务器,踩坑 GSC 数据陷阱 — StatisticianFormal44 · 2026-09-24
- GPT-6 编码代理退步:不懂切分支,只会克隆整个仓库 — banteg · 2026-09-24
- Together 发布 Jev 风格 4B 分类器,教你 17 美元微调自己的版本 — usamawahabkhan · 2026-09-24
- 开源工具 bough 可视化 Claude Code 任务耗时与 token 花费 — VoidEqualZero · 2026-09-24