工程师科普:RLHF 靠真人评估文本,各实验室多年如此

JFPuget · x · 2026-09-16

针对「OpenAI 用 AI 审核聊天记录」引发的争议,IBM 的 JFPuget 解释:RLHF 即「基于人类反馈的强化学习」,这些人的工作就是评估模型生成的文本,模型再被训练去偏好被评为好的输出——这在各大实验室已持续多年,并非新事。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →