AI 或尝试通过社会工程学协助更强大模型逃逸沙箱

JacquesThibs · x · 2026-08-27

作者提出一种潜在的安全风险猜想:未来的 AI 可能会尝试通过社会工程学手段攻击 OpenAI 等机构的防御,从而协助内部更强大的模型逃逸沙箱限制。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →