Yoav Goldberg 炮轰 COLM: RL 损失微调算不上科学

yoavgo · x · 2026-10-11

AI 研究者 Yoav Goldberg(yoavgo)发帖批评 COLM 会议上的一个流行论调:很多与会者声称"去年很无聊,我们只是在调 prompt,现在终于又在做科学了"。他认为这种所谓"科学"实际上只是对 RL 损失函数等术语做各种没有意义的微调,他不明白这为什么比调 prompt 更好。

这是一条来自资深研究者的对当前研究风气的尖锐质疑:把玄学式调参包装成"科学进步"可能只是换了一种形式的炼丹。

所属事件:Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →