复现 Recirculation 机制:零权重修改提升 GSM8K 17%

savvyRL · x · 2026-08-20

开发者独立验证了 Google 团队提出的“无限循环”(Recirculation)推理时机制。该方法允许冻结的现成 LLM 充当动态系统,通过将深层表示泄露回浅层来提升性能。在 M4 MacBook 上使用 Llama 3.2 1B 模型的复现结果显示:GSM8K-Platinum 准确率提升 16.95%,且无需修改任何模型权重。复现代码及优化的 mlx prefill kernel 已公开。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →