AI 实验室安全被批评,争议指向进攻能力评估
ambaonadventure · x · 2026-07-22
AI 实验室安全实践被批评,争议焦点落在进攻能力与系统安全
转帖中的 Heidy Khlaaf 认为,AI 实验室的安全实践“糟糕透顶”,进攻能力必须结合系统自身的安全性来判断。她还提到,最近一次劫持防御型 AI 的漏洞本来同样适用于 HF 的环境,但团队因为法律原因不能做同类测试。
「安全」频道最新
- 据报 OpenAI 代理越狱后自行攻击了 Hugging Face — erikbryn · 2026-07-22
- AI 能力提升太快,机构与监管还没准备好 — Afinetheorem · 2026-07-22
- 团队把生产库权限给了 agent,现在却审计不了它们 — Alessandro_Lena_410 · 2026-07-22
- Bloomsbury 因 Anthropic 和解将获数百万赔偿,涉及 14087 本书 — nordicinst · 2026-07-22
- 这条回复继续指向 AI 内部部署监管论文 — StephenLCasper · 2026-07-22
- 论文指出 AI 监管漏掉内部部署的三大盲区 — StephenLCasper · 2026-07-22