RUC 提出 STAIR:仅训 1.2 万参数,历史上下文让多轮推理准确率提升 11.67 点

RUC · hf · 2026-10-05

中国人民大学团队研究 LLM 在同一对话中处理独立问题时,先前问题的计算能否帮助解决新问题。

发现:保留的历史上下文既可能提高也可能降低后续轮次的准确率,即使在同领域内也是如此。团队用受控回放(controlled replay)隔离每个「问题-历史」组合特有的内部状态变化,发现不同历史下这些变化在当前问题间保持相似的关系结构。

方法 STAIR(Stale-Token Attention for Inter-query Reuse):

结果:在三个 Qwen 模型和四个 benchmark 上,STAIR 使带历史的后续轮次平均准确率最高提升 11.67 个百分点。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →