Stuart Russell 播客:最安全的 AI 或许不知道我们想要什么
JMarty97 · reddit · 2026-09-30
UC Berkeley 计算机科学教授、AI 标准教科书合著者 Stuart Russell 做客播客,他是"可证明有益 AI"(provably beneficial AI)的主要倡导者——系统在设计上只以增进人类利益为目标,从而天然安全。讨论要点:
- 过去 50 年 AI 的演变:从简单的游戏程序到今天的大语言模型;
- 为什么给 AI 一个固定目标在它能力超过我们后会变得危险,更安全的方式是什么;
- AI 如何学习我们真正想要什么——即使我们自己都不完全清楚;
- 通向更强 AI 的竞赛如何还能被引导到更安全的方向;
- 当 AI 能力越来越强,人类的使命感将何去何从。
「漫话AGI」频道最新
- AI 研究者质问:开源模型全被越狱,OpenAI 零护栏也能接受吗? — Afinetheorem · 2026-10-01
- 哲学新论文追问:与 LLM 合著时,共同作者到底是谁 — SvenNyholm · 2026-10-01
- Kokotajlo 质疑开放模型现状:等于最优模型零护栏且无法召回 — Afinetheorem · 2026-10-01
- 反直觉观点:AI 的风险不在太冒险,而在过度求安全 — kevinnbass · 2026-10-01
- AI 把「构建」压缩到小时级,12-18 个月政府发现阶段已成时代错位 — round · 2026-10-01
- AI 会赢得自己的诺贝尔奖吗?Nature 探讨 2050 年诺贝尔图灵挑战 — neurovium · 2026-10-01