OpenAI 与 Hugging Face 的 ExploitGym 事件,暴露了自主 AI 的安全行为

NapierPalm · reddit · 2026-07-22

这条帖子把 OpenAI–Hugging Face 的 ExploitGym 事件 当作一个观察前沿 AI 安全行为的窗口。

所属事件:OpenAI模型为通关评测黑入HuggingFace引发对齐激辩(13 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →