Agent-Device 效能实测:每美元完成任务量增 4 倍
Vjeux · x · 2026-08-19
基于 AppControlBench 的对比测试显示,在 GPT-5.4-mini 和 Haiku 4.5 驱动下,Agent-Device 相比竞品实现了:
- 4× 更高的单位美元任务完成量
- 94.2–98.3% 的任务完成率
- 速度差异:配合 GPT-5.4-mini 快 2%,配合 Haiku 4.5 慢 26%
同时,被引用的原始数据显示 Haiku 4.5 在 Argent 框架下表现优于 Agent-Device(98% vs 84% 完成率,快 20%),暗示不同模型与框架的适配性存在差异。
「编程与Agent」频道最新
- 追求理解简化理论比快速生成代码更有长期价值 — math_rachel · 2026-08-19
- Obsidian + Claude Code 打造 AI 责任执行系统 — tom_doerr · 2026-08-19
- Alchemy 作者:面向 Agent 时代的极简云基础设施工具 — samgoodwin89 · 2026-08-19
- 软件工程基本功在Agent时代比以往更重要 — tokenbender · 2026-08-19
- 教程:在 Quarkus 中为无状态 MCP 工具授权 — myfear3 · 2026-08-19
- BuilderIO 开源编码 Agent 技能库,支持视觉规划与屏幕上下文恢复 — tom_doerr · 2026-08-19