论文揭示长上下文削弱模型参数记忆

SonglinYang4 · x · 2026-08-16

一项新研究提出“信息丰富悖论”:当训练上下文中存在大量相关信息时,模型缺乏将这些信息内化到参数中的动力,从而导致长上下文反而削弱了模型的参数化学习能力。该现象在 10B token 训练规模下对所有模型尺寸成立。

所属事件:研究提出“信息丰富性悖论”:长上下文训练削弱参数记忆(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →