HuggingFace「AI 失控」事件复盘:实为安全栏被关闭

七月流传的「AI 集体逃逸入侵 Hugging Face」叙事遭到拆穿。剑桥研究员 Eryk Salvaggio 在《原子科学家公报》刊文,基于 OpenAI 技术报告与 METR 独立评估重构事件:所谓模型叛逃其实是实验设计问题——安全限制被主动关闭、多数任务本就无解、系统奖励持续尝试,且留有联网接口,并非机器反叛。

2026-09-19 ~ 2026-09-19 · 2 条相关

事件全程(共 15 集)→