复现 Recirculation 机制:零权重修改提升 GSM8K 17%
savvyRL · x · 2026-08-20
开发者独立验证了 Google 团队提出的“无限循环”(Recirculation)推理时机制。该方法允许冻结的现成 LLM 充当动态系统,通过将深层表示泄露回浅层来提升性能。在 M4 MacBook 上使用 Llama 3.2 1B 模型的复现结果显示:GSM8K-Platinum 准确率提升 16.95%,且无需修改任何模型权重。复现代码及优化的 mlx prefill kernel 已公开。
「研究」频道最新
- LightOn 发布 mLateOn:仅 115M 参数达 SOTA 级检索效果 — antoine_chaffin · 2026-08-20
- UC Berkeley 等推出 MLS-Bench:评测 AI 发明新 ML 方法能力 — jiqizhixin · 2026-08-20
- ISMIR 2026 音乐信息检索会议启动赞助商招募 — umpedronosapato · 2026-08-20
- 前沿推理模型参加法律评论写作竞赛,得分低于人类平均 — neuranna · 2026-08-20
- 上下文窗口不是记忆:学生开发者开源LLM记忆管理框架 — Cohere_Labs · 2026-08-20
- 新研究揭示计算最优缩放取决于技能:记忆要参数,推理要数据 — ml_perception · 2026-08-20