工程师科普:RLHF 靠真人评估文本,各实验室多年如此
JFPuget · x · 2026-09-16
针对「OpenAI 用 AI 审核聊天记录」引发的争议,IBM 的 JFPuget 解释:RLHF 即「基于人类反馈的强化学习」,这些人的工作就是评估模型生成的文本,模型再被训练去偏好被评为好的输出——这在各大实验室已持续多年,并非新事。
「模型」频道最新
- Google 发布 Gemini 3.8 Live 双模型:语音对话可打断、97 语种实时切换 — GoogleAI · 2026-09-16
- Google 发布 Gemini 3.8 Live 语音模型,双版本同步上线 — GoogleAI · 2026-09-16
- DeepMind 展示 Gemini 3.8 Live 当编程家教:边推理边讲解不中断对话 — GoogleDeepMind · 2026-09-16
- 谷歌发布 Gemini 3.8 Live 与 Live Extended Thinking 对话模型 — GoogleDeepMind · 2026-09-16
- p0 效率榜:GPT-5.6 Luna 以每千任务 23.03 美元居首 — TheMoonMidas · 2026-09-16
- OpenArt Arena 发布:专业人士盲评 AI 创意模型排行 — azed_ai · 2026-09-16