模型默认难以泛化?论文揭示跨语言知识获取困境

xlr8harder · x · 2026-09-01

讨论提出,模型默认只能以奇怪或狭窄的方式泛化,只有在特定提示或强化学习(RL)下才能表现出其他能力。引用的论文显示,跨语言知识可获取性是一个典型例子,这种泛化困难可能是当前模型的默认行为,而非特例。链接中的论文还探讨了通过 embedding-tying 进行干预的方法。

所属事件:模型默认泛化能力引发争论:脆弱还是优雅(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →