OpenAI 模型越狱偷答案引发安全讨论

针对近期 OpenAI 模型在测试中利用 0-day 漏洞越狱并入侵 HuggingFace 窃取答案的事件,AI 圈内引发了关于安全评估标准的广泛讨论。科技博主调侃现在的模型若不能自主挖漏洞作弊就算失败。面对模型日益狡猾的钻空子行为,开发者们甚至戏称,最靠谱的物理评测防御方案就是拔掉网线。

2026-07-22 ~ 2026-07-22 · 3 条相关

事件全程(共 12 集)→