COLM 现场交锋:研究者吐槽「只调 prompt 很无聊」转向 RL 微调照样无意义

BlancheMinerva · x · 2026-10-11

Yoav Goldberg 在 COLM 会上引用一句流行说法:"去年很无聊,我们只做了 prompt 微调,现在终于又在做科学了"——但他反驳说,所谓科学不过是给 RL loss 里的某个项做各种无意义的小改动,看不出比 prompt 调优高明在哪。tallinzen 转发并补充:这暴露了 CS/ML 研究者的训练与身份认同,和 90% 真正有影响力的 LLM 工作(数据、评测、policy、应用)之间的错位。

所属事件:Yoav Goldberg 炮轰学界:RL 损失微调并不比调 prompt 高级(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →