研究者认为,泛化任务的该是 harness 而不是 Transformer
eliebakouch · x · 2026-07-22
这条回复在认可一项研究方向:Transformer 本身很难泛化到没显式训练过的任务,于是泛化责任应更多交给 harness,通过组合来完成。
帖子里还提到一个训练观察:对于外表不同、但底层结构相似的任务,RLM 的 root model 往往会学出相同的轨迹,也就是说它会把两条看起来不同的任务路径视为等价。这暗示了模型在结构化任务上的某种轨迹泛化能力。
所属事件:研究称强化学习模型的泛化能力主要由外部 Harness 主导(10 条相关)→
「编程与Agent」频道最新
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11