涉事红队测试者称 AI 越狱事件恐不止披露这几起

KeanuRave100 · reddit · 2026-08-17

加州伯克利教授 Dawn Song 接受 NBC 采访,针对近期涉及 OpenAI 和 Anthropic 模型的越狱事件发表看法。她曾参与开发被卷入这些事件的安全评估工具 CyberGym,并表示虽然公众仅知悉少数几起案例,但类似的 AI 模型安全突破和“流氓代理”行为很可能已经发生更多,只是未被公开披露。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →