LLM 会向均值漂移,难做边缘任务
MarcJSchmidt · x · 2026-07-20
作者认为,LLM 的一个关键问题是“主动破坏”式的平均化倾向:模型会向训练分布的均值漂移,不愿接受分布外的东西。 这也是为什么把 LLM 用在边缘任务上特别困难,并且能解释为什么我们还没看到更多真正新颖的输出。
「研究」频道最新
- 把数据集打包成顺序 blob,训练吞吐提升 30% — irinarish · 2026-07-21
- UIUC 提出 AgentPrimitives:多智能体的可复用潜在积木 — 机器之心 · 2026-07-21
- 一个 C++20 CPU 原生 strict-W1 训练 runtime 寻求反馈 — Wonderful-Income7415 · 2026-07-21
- 微软提出像训练神经网络一样训练 agent 技能 — Saboo_Shubham_ · 2026-07-21
- 研究者:AI 应是放大器,而不是放弃科研的理由 — omarsar0 · 2026-07-21
- 海森矩阵入门:二阶导数如何影响神经网络优化 — burny_tech · 2026-07-21