开源库 Bergson 整合训练数据归因方法,探究 LLM 泛化与失准之源
zetalyrae · x · 2026-10-05
研究者 luciaquirke 团队发布新论文并推出开源库 Bergson,聚焦一个关键问题:LLM 如何泛化、为何有时会变得 misaligned?
他们的切入点是训练数据:通过数据归因(data attribution)方法追溯模型行为与训练样本之间的关联。Bergson 把覆盖多种算力预算的数据归因方法整合到同一开源库中,方便研究者按自身资源选择合适的技术来分析模型的泛化与对齐问题。
「研究」频道最新
- Cohere Labs 将办「可信数学 AI」讲座,10 月 5 日线上举行 — Cohere_Labs · 2026-10-05
- ICML 2026 论文集上线 PMLR,共 306 卷收录首尔大会全部论文 — lawrennd · 2026-10-05
- 神经科学家 Anil Seth TED 演讲:AI 不会拥有意识,人们是在云中看出人脸 — anilkseth · 2026-10-05
- CMU 发布 cua-speedrun:首个统一测 computer-use agent 速度成本的基准 — rsalakhu · 2026-10-05
- TernaryQuench 开源 Qwen3 三值量化训练全流程,可直接 Ollama 跑 — casper_hansen_ · 2026-10-05
- Xaira 晒 AI 制药全景:「10 倍药物、10 倍患者、10 年」,GPCR 靶点已出早期成果 — BoWang87 · 2026-10-05