多模型路由实测:同成本下 LLM 错误率直降 46%

SucceededMind · x · 2026-09-04

Martian 发布「AI Frontier」研究:在 16 个常用 benchmark(TerminalBench、LiveCodeBench 等)上,跨模型路由比单一最强模型减少 46% 错误,且成本不变。配套发布了交互式网站与学术论文。

关键发现:

所属事件:研究称多模型路由同成本下错误率降 46%,基准低估 AI(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →