无需训练提升深度?Recirculation 论文
teortaxesTex · x · 2026-08-19
论文提出一种名为「Recirculation」的推理时架构增强技术。通过将上层激活注入到下一步的底层,让模型在不重新训练的情况下作为动力系统跟踪信念状态。该方法在 Gemma3 上实现了 23% 困惑度降低和 GSM8k 21% 准确率提升,且推理阶段几乎无额外延迟。
所属事件:Recirculation新方法无需重训即可提升模型推理能力(3 条相关)→
「研究」频道最新
- 无需重训,新方法让基础模型自改架构提升推理能力 — TheGradient · 2026-08-20
- RAG 攻击可制造虚假自信,论文称需监测注意力分布 — rohanpaul_ai · 2026-08-20
- 弱对抗网络求解 NS-Brinkman 方程,优于传统 PINNs — FrnkNlsn · 2026-08-20
- 斯坦福发布 ENCODE GRAMMAR 基因组 AI 工具快速上手指南 — anshulkundaje · 2026-08-20
- 北大微软提出 BCP:轻量级策略提升机器人重规划效率 — 机器之心 · 2026-08-20
- AI 智能体浏览器里叠积木成功,具身智能版 LMArena 竞技场初现 — NovaCoding · 2026-08-20