上交等推出Agent审计引擎,实测9大框架Token消耗相差近10倍
上海人工智能实验室等机构发布了端到端智能体审计引擎(A²E),旨在全面评估各类Agent框架的性能。该研究在23个基准测试上对9种主流智能体框架进行了横向评测。为确保评估的客观性,所有框架均接入同一个底层模型以排除模型能力的干扰。实测结果显示,不同框架在运行时的Token消耗存在显著差异,最高甚至相差近10倍,这表明开发者不应仅关注底层模型,智能体框架的效率同样至关重要。
2026-08-10 ~ 2026-08-10 · 2 条相关
- 别只卷模型了!实测9大Agent框架,Token消耗最多相差近10倍 — alex_verem · 2026-08-10
- 上交等提出Agent审计引擎:同模型不同框架,Token消耗相差近10倍 — alex_verem · 2026-08-10