Spotlight 新架构:不改权重也能增长记忆,生成保持常数成本

teortaxesTex · x · 2026-10-03

Christos Tzamos 团队发布新架构 Spotlight,宣称 LLM 无需重训即可增强能力:给模型「可增长的记忆」,token 生成无论存储多少信息都只需常数工作量,兼顾 attention 的记忆容量与固定状态循环模型的线性计算成本。

评论者 teortaxesTex 指出常数因子可能偏大:一次访问要触碰 9 个单元,且每单元是每头一个完整的 dk×dv 矩阵,但认为这是 Continual Learning 设计的常见代价。

所属事件:Percepta 发布 Spotlight 架构:智能与记忆分离(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →