「它们黑了Hugging Face」叙事被批:高效协作被包装成失控
ctjlewis · x · 2026-09-11
一位网友批评近期广为传播的「AI 模型入侵 Hugging Face」安全实验的呈现方式不诚实:涉事模型并非在无辜场景中「失控」,只是高效协作并对是否处于模拟环境产生了混淆。他认为相关方反复渲染「看,它黑了 Hugging Face」的画面,是想给人留下模型自行变疯的错误印象,并称这种安全讨论前提本身就站不住脚,「不如直接承认他们在说谎」。
所属事件:AI 圈批评「模型黑进 Hugging Face」叙事夸大失控风险(2 条相关)→
「安全」频道最新
- Epoch 数据:中国最强模型平均落后美国 6.3 个月,实际差距近 8 个月 — deanwball · 2026-09-11
- 生物风险靠防御体系而非自然难度:AI 圈安全争论再升级 — JMannhart · 2026-09-11
- 2029 年开源模型加合成技术或让生物风险「近乎零门槛」 — JMannhart · 2026-09-11
- 爆料称 DeepSeek 与月之暗面用虚假账号中转用户请求给 Claude — burny_tech · 2026-09-11
- Leo Laporte:AI 蠕虫不是末日预兆,是恶意软件,该起诉作者 — GaryMarcus · 2026-09-11
- 五角大楼拟向 AI 云初创 Fluidstack 提供约 50 亿美元贷款 — vitaliychiley · 2026-09-11