Elo-per-token 分析:LLM Agent 测试时策略为何先快后慢

Kaiyuan Liu · hf · 2026-09-15

论文提出 Elo-per-token 分析方法研究 LLM Agent 的测试时策略。核心发现:agent 的表现最初比独立采样扩展得更快,但随后会放缓;而多个并行短会话的表现优于单个长会话。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →