Yoav Goldberg 炮轰 COLM: RL 损失微调算不上科学
yoavgo · x · 2026-10-11
AI 研究者 Yoav Goldberg(yoavgo)发帖批评 COLM 会议上的一个流行论调:很多与会者声称"去年很无聊,我们只是在调 prompt,现在终于又在做科学了"。他认为这种所谓"科学"实际上只是对 RL 损失函数等术语做各种没有意义的微调,他不明白这为什么比调 prompt 更好。
这是一条来自资深研究者的对当前研究风气的尖锐质疑:把玄学式调参包装成"科学进步"可能只是换了一种形式的炼丹。
所属事件:Yoav Goldberg 炮轰学界风向:RL 微调并不比调 prompt 高级(2 条相关)→
「漫话AGI」频道最新
- AI 专家「5% 灭绝风险」说法失实,调查原题另有措辞 — jessi_cata · 2026-10-11
- 投资人用数据反驳智能爆炸论:AI自我改进循环弱5到10倍 — jessi_cata · 2026-10-11
- SRE 从业者:AI 不足以让我此生摆脱 on-call 值班 — RealGeneKim · 2026-10-11
- Karpathy:别把 LLM 当实体,它是模拟器而非「你」 — ZeroStateReflex · 2026-10-11
- 陶哲轩发梗图:就像开一种没人真正理解的药 — jfischoff · 2026-10-11
- 用 ChatGPT 装聪明算欺骗吗?AI 圈激辩约会中的 AI 使用 — jd_pressman · 2026-10-11