21个模型-框架组合实测:换Agent框架几乎不影响成功率,却能大幅改变成本
iScienceLuvr · x · 2026-09-19
一篇新文章对 7 个模型 × 3 个 harness 共 21 个「模型–框架」组合做了对比分析,得出三个发现:
- harness 的选择对任务成功率影响很小,但对成本影响显著——不同 harness 跑同一个模型,花费可能差很多;
- 简单的 harness 也能打得过复杂框架,并非越复杂越强;
- 模型在别家的 harness 上有时比自己官方的还表现更好。
作者的结论是:像 Pi 这类简单 harness 可能反而是更优选择。对选型 AI 编码/agent 框架的人来说,这意味着与其堆功能,不如关注成本与简单性。
「编程与Agent」频道最新
- 谷歌发布 12 页 Agentic Engineering 指南:五阶段构建 agent 团队 — blaizedsouza · 2026-09-19
- AgentRun:专攻高频重复知识工作的 agent harness 设计 — blaizedsouza · 2026-09-19
- Qwen 3.8 27B 单卡 RTX 5090 本地跑通全代码动画制作 — Acceptable-Object390 · 2026-09-19
- Compiler Explorer 年编译 9200 万次,创始人详解背后架构 — blaizedsouza · 2026-09-19
- Netflix 打造模块优先、对 Agent 友好的全新 Java 工具链 — blaizedsouza · 2026-09-19
- MCP 工具暴露经验:别把 CRUD 端点全做成工具,合并+枚举参数才好用 — Relevant-Potential17 · 2026-09-19