对齐圈争论:前沿实验室的目标塑造能力被高估了吗

jeremygillen1 · x · 2026-08-19

对齐研究者 Jeremy Gillen 与 Jacques Thibs 继续交锋。Thibs 认为前沿实验室尚未真正意识到「AI 目标塑造有多难」,并预期问题会被「刚好够用地」解决;对于 AI 不合作的担忧,一些人根本不信,另一些人则相信监控手段足以让 AI 保持合作。Gillen 反驳:如果他们真信问题会解决,就不该再 advocating 更好的沙箱。

所属事件:对齐研究者激辩:沙盒安全与目标塑造能力决定 ASI 对齐成败(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →