安全研究员:六年来最有趣的 AI 漏洞多藏在安全与安保交叉处
wunderwuzzi23 · x · 2026-10-08
安全研究者 wunderwuzzi 分享其六年 AI 安全测试经验的观察:他发现的最有意思的 AI 漏洞,大多出现在「模型安全(safety)」与「系统安全(security)」的交叉地带——即绕过模型护栏与利用系统漏洞叠加的场景。他还附上自己的《Machine Learning Attack Series》系列文章链接,认为至今仍值得阅读。
「安全」频道最新
- 犹他州率先允许 AI 开处方药,无需医生直接审核引争议 — NathanpmYoung · 2026-10-08
- Polymarket 定价:美国 2026 年前通过 AI 安全法案仅 13% — Polymarket · 2026-10-08
- National Compute 向白宫捐赠 1 亿美元算力额度 — typewriters · 2026-10-08
- TheZvi 长文警告:让 AI 自动化做对齐研究是最危险计划 — TheZvi · 2026-10-08
- 研究:ChatGPT 青少年版自杀话题安全警报未触发 — Polymarket · 2026-10-08
- Zvi 记 The Curve 大会:与会的对齐研究者处境意识反而下降了 — Don't Worry About the Vase (Zvi) · 2026-10-08