递归语言模型靠短任务训练,却泛化到长 8—32 倍任务
heghbalz · x · 2026-07-21
- 这篇论文提出:**语言模型的 harness(调用/编排框架)本身可以成为组合泛化器**。 - 核心思路是用 **递归式 LM** 把上下文和子任务外包出去,让主模型反复面对一种更简单、可复用的结构,而不是直接处理一个超长大任务。 - 作者用 **短任务** 训练,但报告模型可以泛化到 **长 8–32 倍** 的任务。 - 论文强调:每一步局部都保持在分布内,但模型最终学到的是任务背后的 **分解策略**,而不是死记任务本身。 - 这相当于把“泛化”从单纯依赖更多数据、更长上下文,改写成了一个 **harness 设计问题**。
所属事件:研究称强化学习模型泛化能力主要由外部 Harness 主导(9 条相关)→
「研究」频道最新
- AlphaFold 助力蛋白工程,筛遍 4.5 万酶和 5 亿变体 — pushmeet · 2026-07-21
- OCT-Bench 用 10,076 题测试多模态模型能否读懂视网膜扫描 — Baochen Fu · 2026-07-21
- 12GB 显存也能训练 LTX-2.3 脸+声音 LoRA,但代价不小 — __alpha_____ · 2026-07-21
- 后续论文称数字孪生可让临床试验更自适应 — techhalla · 2026-07-21
- npj Digital Medicine 论文梳理因果推断与数字孪生临床试验路线图 — techhalla · 2026-07-21
- AI 性能瓶颈正转向材料科学,而不只是算力 — nordicinst · 2026-07-21