伯克利推出 CL-Bench:评估大模型持续学习能力

加州大学伯克利分校推出了全新的持续学习基准(Continual Learning Bench,简称 CL-Bench)。该基准旨在评估大语言模型智能体在连续任务中的学习与记忆更新能力,衡量其能否通过序列经验真正提升自身表现。研究发现,在部分情况下,简单的上下文学习方法甚至能击败复杂的持续学习架构。

2026-08-12 ~ 2026-08-13 · 2 条相关