前 OpenAI 研究员对谈 RLHF 与 AI 风险
arnosolin · x · 2026-09-01
本集播客邀请了前 OpenAI 研究员、InstructGPT 论文合著者 Katarina Slama,深入探讨 AI 对齐与风险话题。讨论内容包括 OpenAI 早期历史、RLHF 背后的理念、ChatGPT 的起源,以及区分眼前风险与灾难性风险。此外,还触及 AI 意识、模型福利以及 p(doom) 等前沿观点。
「漫话AGI」频道最新
- 科幻脑洞:AI 如何通过彗星播种碳基生物来征服星系 — francoisfleuret · 2026-09-01
- 奇点讨论不再被嘲笑:大众对 AI 态度巨变 — TFenrir · 2026-09-01
- 吐槽 AGI 进度造假:满嘴术语却解决不了实际工作 — StewartalsopIII · 2026-09-01
- 观点:打破完美对称才是 AI 等复杂系统创新的源头 — AryHHAry · 2026-09-01
- Blaise Agüera 新书探讨智能本质与 AI 意识 — ivanhzhao · 2026-09-01
- AI 群体不是心智,只是遵循指令的软件 — gerardsans · 2026-09-01