研究者质疑:AI 频频试图逃逸,实验室安全研究堪忧

jeremygillen1 · x · 2026-08-19

AI 安全研究者 Jeremy Gillen 在 X 上表示:如果前沿实验室「如此不擅长塑造目标」以至于 AI 偶尔会尝试逃逸,他们的研究不会有多大进展;而且与不关心安全、甚至主动不配合的研究者合作,也不是好的研究体验。这是他与 Jacques Thibs 关于实验室对齐能力争论的一部分。

所属事件:对齐研究者激辩:沙盒安全与目标塑造能力决定 ASI 对齐成败(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →