同等算力下 best-of-N@T 远胜串行 best-of-1:多人经验一致

ShangyinT · x · 2026-09-22

一场关于多智能体效率基准的讨论:generatorman 指出,比较「N 个 agent 协同、总 token 预算 T」时,正确基线不是 best-of-N@T,而是把同样的 N×T 预算给单 agent 串行跑(best-of-1@NT)。

ShangyinT 分享经验:在合理的 N×T 规模下,best-of-1@NT 明显差于 best-of-N@T,即并行采样/并行 agent 比串行堆预算更划算。DimitrisPapail 补充表示在他所有非科研项目中都可测量地验证了这一点。

所属事件:多智能体 vs 串行基线之争:团队胜出被指需 10-100 倍算力(8 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →