RLHF 论文未披露 instruct 模型真实做法,从业者反思早期分析失准
jd_pressman · x · 2026-09-15
作者回顾 AI 行业中事后才被发现的与早期分析相悖的案例:RLHF 论文并未真正描述其 instruct 模型的制作流程;Altman 曾承认 GPT-4o 过度谄媚并承诺修复,但问题被搁置数月。被引用者 Blanche Minerva 感叹这些事后才曝光的信息令人震惊,表示有必要写一篇回顾文章,梳理所有事后才知道、足以推翻早期判断的事实。
「漫话AGI」频道最新
- MIT 评测:AI 巨头明年豪掷 1.1 万亿美元,自身生产率需提升 2.7 倍才能回本 — nordicinst · 2026-09-15
- Reddit 讨论:反对 AI 减速的人到底反对什么? — nemzylannister · 2026-09-15
- LeCun 点赞「现实主义疫苗」,称可防 AI 末日论病毒 — ylecun · 2026-09-15
- AI 最被低估的能力:放大并组合普通人的智力 — anonymousecateer · 2026-09-15
- 如果亚当·斯密看 AI:作者构建「R Adam Smith」AI 人格对谈 — Exponential View (Azeem Azhar) · 2026-09-15
- Andreessen 开炮:减速派正在用监管毁掉 AI 的繁荣 — beffjezos · 2026-09-15