Declarative Attention 协议:让模型自己声明注意区域,解码省 52% KV 读取

eigenlaplace · reddit · 2026-09-05

arXiv 新论文提出 Declarative Attention(DA):与其用外部代理分数预筛 token,不如让模型在思维链里自己声明它需要关注上下文的哪个部分。

作者认为这开辟了稀疏注意力的新轴,配合训练式方法还有更大潜力。

所属事件:新论文让模型自控注意力,KV 读取省 52%(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →