为什么每个 LLM 都需要人审?因为是我们亲手把它放进环里的

ccerrato147 · x · 2026-09-20

线程段落:Diogo Almeida 的回答——每个 LLM 都需要 human in the loop,是因为我们真的把它们放进了环里。RLHF 两步:收集人类偏好、优化人类偏好;目标从来不是“正确运行软件”,而是“让人类点头”。

所属事件:ChatGPT 联合作者论述为何 AI 不能自主决策:RLHF 只优化让人点头(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →