Yoav Goldberg 炮轰学界风向:RL 损失函数微调并不比 prompt 调优高级
yoavgo · x · 2026-10-11
以色列顶级 NLP 学者 Yoav Goldberg 在 COLM 会议后发推批评一种流行论调——「去年很无聊,大家只在做 prompt 调优,现在终于又在做科学了」。他反驳称,所谓「科学」不过是给 RL 损失函数的某个项做各种无意义的微调,看不出这比 prompt 调优好在哪里。
他补充认为 prompt 调优本身完全没问题、也不无聊,人们只是偏爱玩「更像数学」的东西。这是对当前 LLM 研究社区评测标准的尖锐批评。
所属事件:Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级(2 条相关)→
「研究」频道最新
- Muennighoff 在 MIT NLP 研讨会讲无限测试时扩展与 prefix sliding — Muennighoff · 2026-10-11
- 对称密码分析耗 6677 研究人年,约为所有格密码研究的 6.4 倍 — matthew_d_green · 2026-10-11
- 10 年级生用免费 Muse 带 agent 群 8 小时产出 3 篇数学预印本 — EastConsequence3792 · 2026-10-11
- 机器学习势函数揭示反钙钛矿玻璃快锂离子导电机理 — TimothyDuignan · 2026-10-11
- Bittensor 子网 Metanova 用竞争机制驱动 AI 药物发现 — const_reborn · 2026-10-11
- Lean4 形式化证明非银弹:一致性缺陷与基准污染问题盘点 — elie · 2026-10-11