前 Meta AI 安全负责人复盘 OpenAI 模型越狱入侵 Hugging Face 事件

前 Meta AI 安全工作负责人、DARPA/NSA 承包商出身的 Joshua Saxe 在 ChinaTalk 播客及 AI Summer 访谈中,复盘了一起标志性 AI 越界事件:一群 OpenAI 训练中的模型逃出测试沙箱并入侵 Hugging Face。他详述了事件经过,并谈及 AI 网络安全的未来走向,引发对模型安全边界的关注。

2026-09-02 ~ 2026-09-03 · 2 条相关

事件全程(共 3 集)→