Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级

以色列知名 NLP 学者 Yoav Goldberg 在参加 COLM 会议后发推批评一种流行论调:不少与会者声称"去年很无聊,大家只是在调 prompt,现在终于又在做科学了"。他反驳指出,所谓的 RL 损失函数微调并不比 prompt 调优更高级,也不算真正的科学进展,质疑学界对研究价值的判断标准,该言论引发社区热议。

2026-10-11 ~ 2026-10-11 · 2 条相关

另有 1 条近重复转述:yoavgo