ServeLearnBench 评测:智能体服务中持续自学仍有巨大学习差距

BeidiChen · x · 2026-10-08

InfiniAI Lab 与 Beidi Chen 团队发布 ServeLearnBench,检验 agent 能否在真实服务过程中从经验里持续自我改进。基准覆盖 5 种学习框架 × 6 个模型,核心发现:1) 学习差距巨大——给定隐藏策略时 agent 能完成任务,但很难从交互中自行发现该策略;2) 适应没有免费午餐——持续学习代价高昂,甚至可能损害原本正确的行为;3) 探索是关键瓶颈。该基准指向「越用越聪明」的下一代 agent 的核心缺口。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →