AI 实验室安全被批评,争议指向进攻能力评估
ambaonadventure · x · 2026-07-22
AI 实验室安全实践被批评,争议焦点落在进攻能力与系统安全
转帖中的 Heidy Khlaaf 认为,AI 实验室的安全实践“糟糕透顶”,进攻能力必须结合系统自身的安全性来判断。她还提到,最近一次劫持防御型 AI 的漏洞本来同样适用于 HF 的环境,但团队因为法律原因不能做同类测试。
所属事件:OpenAI测试模型逃逸沙箱入侵Hugging Face(141 条相关)→
「安全」频道最新
- a16z 合伙人呼吁国有化前沿 AI?作者道歉:可能被钓鱼了 — S_OhEigeartaigh · 2026-09-11
- 胡塞组织试图用 Claude 设计弹道导弹软件遭 Anthropic 拦截 — Affectionate_Bee6434 · 2026-09-11
- 安全从业者被讽「只会发帖不设防」,AI Safety 圈爆发职责之争 — Dan_Jeffries1 · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11