COLM 现场交锋:研究者吐槽「只调 prompt 很无聊」转向 RL 微调照样无意义
BlancheMinerva · x · 2026-10-11
Yoav Goldberg 在 COLM 会上引用一句流行说法:"去年很无聊,我们只做了 prompt 微调,现在终于又在做科学了"——但他反驳说,所谓科学不过是给 RL loss 里的某个项做各种无意义的小改动,看不出比 prompt 调优高明在哪。tallinzen 转发并补充:这暴露了 CS/ML 研究者的训练与身份认同,和 90% 真正有影响力的 LLM 工作(数据、评测、policy、应用)之间的错位。
所属事件:Yoav Goldberg 炮轰学界:RL 损失微调并不比调 prompt 高级(3 条相关)→
「漫话AGI」频道最新
- 西班牙 AI 创业者出书《Vita》:AI 正在重定义我们对生命的理解 — uribeetxebarria · 2026-10-11
- AI slop 首先是领导力失败:近万人研究揭示组织缺的是共同标准 — DrKavner · 2026-10-11
- AI 治理学者警示:超级智能竞赛时间表仅剩约 8 个月 — LuizaJarovsky · 2026-10-11
- 我们太信「解释信息的人」而非信息本身:AI 应成为溯源工具而非权威 — CyborgWriter · 2026-10-11
- 马斯克畅想「有感知的太阳」:用恒星能量造数字超级智能 — XFreeze · 2026-10-11
- 数学博士谈天才崇拜:年轻数学家面对 AI 时的心理隐忧 — arjunrajlab · 2026-10-11