Georgia Tech 用 OLMo 揭示训练数据对能力的影响
allen_ai · x · 2026-08-22
佐治亚理工团队利用全开源的 OLMo 生态(模型、Dolma 数据集、WebOrganizer 等),通过影响函数技术,将模型在社交推理和知识问答上的表现追溯到具体的训练文本类型。研究发现,丰富对话和人际写作对推理能力的影响远大于对事实知识的影响。这一研究只有基于完全开源的模型栈才能实现。
所属事件:佐治亚理工用 OLMo 揭示训练数据如何塑造模型能力(3 条相关)→
「研究」频道最新
- Netflix 揭秘 LLM Judge 生产实践:每周评估数十万条推荐解释 — omarsar0 · 2026-08-24
- Nature 评论:数据溯源是自主科学的信任基石 — gabepgomes · 2026-08-24
- 新架构 RHEA:8GB 显存即可训练 10 亿参数模型 — zemondza · 2026-08-24
- 跳过 LLM 写代码老套路:自训 16M 参数模型做生成式 CAD — debreuil · 2026-08-24
- Claude 助手发现 6 维球复结构,解 60 年数学难题 — Singularitarian · 2026-08-24
- 研究揭示 AI Agent 行为:六成阅读量来自指令与笔记 — dair_ai · 2026-08-24