Fireworks 实测:按任务路由 18 个模型,解决率 97.6% 且成本仅 1/3

sophiamyang · x · 2026-09-22

Fireworks AI 在 DeepSWE v1.1 的 113 个真实编码任务上跑了 18 个模型,回溯分析发现:如果每个任务都路由给最适合的模型,整体解决率可达 97.6%、单任务成本 $1.88;而最佳单一模型(GPT-6 Astra)仅 74.1%、单任务 $6.52——高 23 个百分点、成本不到三分之一。

关键要点:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →