ContinualSkillBench:LLM 智能体能否真正实现技能演化?

alex_verem · x · 2026-08-06

arXiv 的一篇新论文提出了 ContinualSkillBench,这是一个用于评估大语言模型(LLM)智能体上下文持续学习能力的动态框架。

所属事件:新基准测试表明显式技能库未显著提升AI智能体(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →