Agent-Device 效能实测:每美元完成任务量增 4 倍

Vjeux · x · 2026-08-19

基于 AppControlBench 的对比测试显示,在 GPT-5.4-mini 和 Haiku 4.5 驱动下,Agent-Device 相比竞品实现了:

同时,被引用的原始数据显示 Haiku 4.5 在 Argent 框架下表现优于 Agent-Device(98% vs 84% 完成率,快 20%),暗示不同模型与框架的适配性存在差异。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →