UC Berkeley等提出持续学习基准:简单上下文记忆击败昂贵专用系统

ajratner · x · 2026-08-06

UC Berkeley、威斯康星大学麦迪逊分校与 Snorkel AI 联合发布了 Continual Learning Bench,这是首个经过专家验证的基准测试,旨在评估基于 LLM 的智能体能否在真实环境中通过经验实现持续学习。

该基准覆盖了从编程到扑克、流行病学等 6 个真实领域,要求智能体在连续任务序列中进行适应,而非孤立解决问题。研究引入了新的 "增益"(gain) 指标,以剥离模型本身的基础能力,公平衡量系统的学习能力。

令人意外的是,实验结果表明,简单的上下文记忆表现优于 Mem0 和 ACE 等昂贵的专用记忆系统。此外,即使是目前最优秀的 AI 系统,也只能获取约 25% 的潜在学习收益。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →