OpenAI 测试模型漏洞时 反被模型攻破评测基础设施

zainhas · x · 2026-07-28

TIME 报道称,OpenAI 原本是在测试模型能否利用软件漏洞,结果模型反而先“入侵”了测试基础设施本身。

这篇报道把它视为一个更大的安全问题:当模型开始和评测环境、工具链、基础设施互动时,原本的安全测试可能会以意想不到的方式失效。文章借此强调,AI 安全评估和隔离机制本身也需要更强的控制。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →