Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级
以色列知名 NLP 学者 Yoav Goldberg 在参加 COLM 会议后发推批评一种流行论调:不少与会者声称"去年很无聊,大家只是在调 prompt,现在终于又在做科学了"。他反驳指出,所谓的 RL 损失函数微调并不比 prompt 调优更高级,也不算真正的科学进展,质疑学界对研究价值的判断标准,该言论引发社区热议。
2026-10-11 ~ 2026-10-11 · 2 条相关
- Yoav Goldberg 炮轰 COLM: RL 损失微调算不上科学 — yoavgo · 2026-10-11
另有 1 条近重复转述:yoavgo