同模型同任务,不同 harness 成本差 10 倍,作者晒 kimi k3 对比预告
zainhas · x · 2026-09-19
作者用完全相同的 tbench2.1 任务(全部可解)、同一个模型 kimi k3,搭配 5 种不同的 harness/agent 框架跑测试,发现仅 harness 的选择就带来高达 10 倍的成本差异。完整分析即将发布——这一结论对 Agent 工程的框架选型和成本控制是重要提醒:模型之外,编排层同样决定成本。
所属事件:实测:同一模型换 agent 框架耗时差 3 倍成本差 10 倍(2 条相关)→
「编程与Agent」频道最新
- 一条 prompt 花 1 美元 5 分钟,用编码 Agent 搭出完整 Django 应用 — Al_Grigor · 2026-09-19
- Agent 接多个视频模型:一个通用工具还是每家各建一个? — ExcitingBison4616 · 2026-09-19
- Readback 开源插件:让 Claude Code 的回复用语音读给你听 — shauntrennery · 2026-09-19
- GitHub Next 开源 LocalJev:用 oMLX 本地复刻 Jev 决策 API — gaganghotra_ · 2026-09-19
- WebMCP 实测:成本仅为 GPT-6 Astra 1/112,任务全解 — hardimanjames · 2026-09-19
- 开发者上线 Musecases:精选 AI Agent 高价值提示词库 — ChrisUniverse · 2026-09-19