开源库 Bergson 整合训练数据归因方法,探究 LLM 泛化与失准之源

zetalyrae · x · 2026-10-05

研究者 luciaquirke 团队发布新论文并推出开源库 Bergson,聚焦一个关键问题:LLM 如何泛化、为何有时会变得 misaligned?

他们的切入点是训练数据:通过数据归因(data attribution)方法追溯模型行为与训练样本之间的关联。Bergson 把覆盖多种算力预算的数据归因方法整合到同一开源库中,方便研究者按自身资源选择合适的技术来分析模型的泛化与对齐问题。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →