研究员撰文:自动对齐研究不能靠「抓到 AI 搞鬼再停手」

JacquesThibs · x · 2026-09-02

Jacques Thibodeau 把去年在 PIBBSS Symposium 的演讲整理成博客(约 63 分钟,含完整转录),核心论点是「如果发现 AI 在暗中搞研究破坏就停下」不是可靠的方案,而自动化安全研究中的 dual-use 担忧被夸大了。

内容脉络:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →