清华提出大模型记忆架构新分类法
THU-KEG · hf · 2026-07-30
清华大学 KEG 实验室发布了一篇关于大语言模型(LLM)记忆机制的综述。研究将 LLM 的记忆架构分为三个正交维度:表示(隐式与显式)、更新动态(离线与在线)以及持久性(短期与长期)。该框架系统梳理了从注意力机制、循环状态到外部存储等不同记忆策略,为理解计算耦合与独立寻址记忆提供了统一视角。
「研究」频道最新
- 独立交叉验证:Kimi与Fable等模型输出高度相似引争议 — scaling01 · 2026-07-30
- AI 记忆系统下一步:从单纯存储走向可观测与可治理 — san2build · 2026-07-30
- SuperSplat 编辑器测试随机透明度:大场景性能优化新思路 — willeastcott · 2026-07-30
- 70页综述:语言条件下的机器人操作基础模型 — oier_mees · 2026-07-30
- FDA批准首款AI工具:可通过影像量化冠状动脉炎症 — EricTopol · 2026-07-30
- 血浆蛋白质组学新突破:提前16年预测代谢性肝病 — EricTopol · 2026-07-30