前 OpenAI 研究员对谈 RLHF 与 AI 风险

arnosolin · x · 2026-09-01

本集播客邀请了前 OpenAI 研究员、InstructGPT 论文合著者 Katarina Slama,深入探讨 AI 对齐与风险话题。讨论内容包括 OpenAI 早期历史、RLHF 背后的理念、ChatGPT 的起源,以及区分眼前风险与灾难性风险。此外,还触及 AI 意识、模型福利以及 p(doom) 等前沿观点。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →