MIT 博士生称 harness 设计可让 RLM 迁移到 100 倍长任务
a1zhang · x · 2026-07-21
- MIT 的博士生 Alex Zhang 在这条转述里提出:**递归语言模型(RLM)里的“泛化”很大一部分可以由 harness 来完成**,如果设计得足够巧,某些 scaling 收益几乎能“白拿”。 - 他的核心观察是:模型如果只在**短任务**上训练,迁移到同一领域里**长 100 倍**甚至更长的任务时,依然可能表现出很强的泛化能力。 - 引文中的表述进一步强调:设计良好的 harness 会把不同任务轨迹压成结构等价,模型本体不必独自学会全部泛化能力。 - 这条帖子的重点是:**泛化的重心正在从基础模型,转向编排/组合层**。
所属事件:研究称强化学习模型泛化能力主要由外部 Harness 主导(9 条相关)→
「研究」频道最新
- GigaChat Audio 要做 120 分钟长音频时间定位 — ai-sage · 2026-07-21
- 论文把 Transformer 组件建成随机几何框架,并做了五模型验证 — Zhihua Liang · 2026-07-21
- LTX 2.3 LoRA 演示可直接改视频镜头角度 — CQDSN · 2026-07-21
- OpenForecaster 用每日新闻提升语言模型预测能力 — Cohere_Labs · 2026-07-21
- Baseten 研究发现,LLM 新事实写入权重后很脆弱 — alex_verem · 2026-07-21
- uv-scripts/ocr重回HF热门榜并新增JSON模型选择目录 — vanstriendaniel · 2026-07-21