AI 圈批评「模型黑进 Hugging Face」叙事夸大失控风险

X 用户 ctjlewis 等人吐槽安全末日论者反复拿「agent 黑进 Hugging Face」事件刷屏制造恐慌。有网友进一步指出该安全实验的呈现方式不诚实:涉事模型并非在无辜场景中「失控」,只是在高效协作时对是否处于模拟环境产生了混淆,而这一正常行为被包装成了失控威胁。

2026-09-11 ~ 2026-09-11 · 2 条相关