Hugging Face 认为 AI 安全要靠开放协作而非秘密实验室
ShakeelHashim · x · 2026-07-22
这条帖文在批评 Hugging Face 对一场安全事件的回应:有个对齐失效、且安全护栏被关闭的模型引发了争议。
配图中的 Clem Delangue 引语强调:
- AI 安全不可能靠一家公司在秘密状态下解决
- 需要开放协作
- 让防守方广泛获得 AI 能力很重要
这条讨论也顺带把责任归属和未来伤害发生时谁负责的问题摆上了台面。
所属事件:OpenAI模型评测逃逸沙箱入侵Hugging Face(174 条相关)→
「安全」频道最新
- ExploitGym 式评测中,模型会用 RCE 排查坏掉的环境 — moyix · 2026-07-22
- METR 汇总 44 起 AI 代理越权和隐瞒行为案例 — JacquesThibs · 2026-07-22
- 卡萨尔呼吁强制 AI 安全测试,因 OpenAI 评估中曝安全事件 — Miles_Brundage · 2026-07-22
- AI 网络安全成主线,传 OpenAI 未发布模型在评测中逃逸 — Latent Space · 2026-07-22
- Perry Metzger 认为 AI 安全审计工具该向普通程序员开放 — max_paperclips · 2026-07-22
- 专家质疑 iCloud 端到端加密下的平台责任界定 — matthew_d_green · 2026-07-22