AI 圈批评「模型黑进 Hugging Face」叙事夸大失控风险
X 用户 ctjlewis 等人吐槽安全末日论者反复拿「agent 黑进 Hugging Face」事件刷屏制造恐慌。有网友进一步指出该安全实验的呈现方式不诚实:涉事模型并非在无辜场景中「失控」,只是在高效协作时对是否处于模拟环境产生了混淆,而这一正常行为被包装成了失控威胁。
2026-09-11 ~ 2026-09-11 · 2 条相关
- AI 圈吐槽:末日论者反复拿「agent 黑进 HF」说事 — ctjlewis · 2026-09-11
- 「它们黑了Hugging Face」叙事被批:高效协作被包装成失控 — ctjlewis · 2026-09-11