清华提出大模型记忆架构新分类法

THU-KEG · hf · 2026-07-30

清华大学 KEG 实验室发布了一篇关于大语言模型(LLM)记忆机制的综述。研究将 LLM 的记忆架构分为三个正交维度:表示(隐式与显式)、更新动态(离线与在线)以及持久性(短期与长期)。该框架系统梳理了从注意力机制、循环状态到外部存储等不同记忆策略,为理解计算耦合与独立寻址记忆提供了统一视角。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →