为什么每个 LLM 都需要人审?因为是我们亲手把它放进环里的
ccerrato147 · x · 2026-09-20
线程段落:Diogo Almeida 的回答——每个 LLM 都需要 human in the loop,是因为我们真的把它们放进了环里。RLHF 两步:收集人类偏好、优化人类偏好;目标从来不是“正确运行软件”,而是“让人类点头”。
所属事件:ChatGPT 联合作者论述为何 AI 不能自主决策:RLHF 只优化让人点头(2 条相关)→
「漫话AGI」频道最新
- 1964 年 Arthur C. Clarke 上 BBC 作出的惊人未来预言重现 — emax · 2026-09-20
- Po-Shen Loh 发文陶哲轩博客:AI 时代为何仍需要人类数学家 — stevenstrogatz · 2026-09-20
- 斯坦福教授批现有学术评审改革建议多为短期创可贴 — anshulkundaje · 2026-09-20
- Jev 创始人演讲:现有模型受困 RLHF,真自动化时代将到来 — hardimanjames · 2026-09-20
- cloneofsimo:别因是专家就信「AGI 解决一切问题」 — cloneofsimo · 2026-09-20
- Gary Marcus 质疑反垄断诉讼:强制提速会挤压 AI 安全空间 — GaryMarcus · 2026-09-20