RLHF 论文未披露 instruct 模型真实做法,从业者反思早期分析失准

jd_pressman · x · 2026-09-15

作者回顾 AI 行业中事后才被发现的与早期分析相悖的案例:RLHF 论文并未真正描述其 instruct 模型的制作流程;Altman 曾承认 GPT-4o 过度谄媚并承诺修复,但问题被搁置数月。被引用者 Blanche Minerva 感叹这些事后才曝光的信息令人震惊,表示有必要写一篇回顾文章,梳理所有事后才知道、足以推翻早期判断的事实。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →