Yoav Goldberg 炮轰学界风向:RL 损失函数微调并不比 prompt 调优高级

yoavgo · x · 2026-10-11

以色列顶级 NLP 学者 Yoav Goldberg 在 COLM 会议后发推批评一种流行论调——「去年很无聊,大家只在做 prompt 调优,现在终于又在做科学了」。他反驳称,所谓「科学」不过是给 RL 损失函数的某个项做各种无意义的微调,看不出这比 prompt 调优好在哪里。

他补充认为 prompt 调优本身完全没问题、也不无聊,人们只是偏爱玩「更像数学」的东西。这是对当前 LLM 研究社区评测标准的尖锐批评。

所属事件:Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →