对齐研究者长文:自动化对齐研究不能靠「抓住 AI 搞鬼就停」

JacquesThibs · x · 2026-09-11

Jacques Thibodeau 发布其在 PIBBSS Symposium(2025 年 9 月)的演讲全文与幻灯片(约 63 分钟),核心论点:

文中还链接了他此前关于自动化 AI 安全研究可做什么、四种「自动化对齐研究」含义辨析的文章,以及其初创公司 Coordinal Research 的经历。附录整理了演讲之后的相关进展,包括 Jan Leike 的《Alignment is not solved》等 2026 年工作。适合对齐研究方向读者系统阅读。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →