按任务路由比单一最佳模型高出 15 个点

ZainHasan6 · x · 2026-07-21

这条帖子给出了一张对比图,主题是**按任务路由**和“单一最佳模型”之间的差距。 - 最佳单模型(Sol):**72.3% pass@1** - 完美按任务路由(oracle):**86.7%** - 三模型并集(pass@4 union):**96.5%** 帖子想表达的结论是:即使在前沿模型上,**把任务分给最适合的模型** 仍然能带来很大增益;文中还声称,对 `{Kimi K3, Fable 5, GPT 5.6 Sol}` 做 oracle routing,可以比前沿 SOTA 再提升 **15%**。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →