MIT 提出动态压缩机制,解决长上下文模型信息丢失

burkov · x · 2026-08-25

MIT CSAIL 研究人员提出“动态压缩”方法,解决长上下文循环模型因过早压缩而丢失未来任务所需关键信息的问题。该方法保留原始序列,在当前任务揭示需求时重新扫描相关 token,以此重写内部状态。实验表明,在记忆和复用学习函数的任务中,该方法能显著减少准确复用所需的内部状态大小。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →