AI 安全研究者 Jeff Ladish:别按当前水平设计 agent 沙箱

JeffLadish · x · 2026-10-04

知名 AI 安全研究者 Jeff Ladish 发推表示,看着人们认真讨论各种 agent 沙箱隔离技术,他觉得很有意思——因为这些讨论默认了 agent 的「黑客能力」会停留在今天这个水平,而这几乎不可能。

在后续推文中他进一步点题:想想 GPT-3 时代能做到的沙箱逃逸,再想象 GPT-9 能做到什么。核心观点是:针对当前模型能力设计的隔离方案,很快会被能力增长甩在身后,安全设计需要前瞻性。

所属事件:安全研究者警告:按当前水平设计 AI 沙箱过于短视(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →