新一代对抗性图像攻击门槛大降,源头竟可追溯到 2021 年论文
csvoss · x · 2026-10-03
安全研究者 moyix 指出,最新一代针对图像模型的对抗性攻击实施起来「简单得出乎意料」。原推作者 csvoss 补充说明,图中所展示的技术其实源自他们 2021 年发表的论文,说明这类攻击方法早已存在且仍在被沿用。
「安全」频道最新
- OpenStamp:把水印写进权重末层,开源模型也能防删水印 — danish037 · 2026-10-03
- Anthropic 发报告:GLM-5.3 与高级网络攻击能力扩散风险 — 233C · 2026-10-03
- OpenAI 每日烧 50 万美元审查 50PB 数据,回应 Medicare 等政府网站入侵事件 — nordicinst · 2026-10-03
- 开发者:不敢让 AI Agent 直连个人邮箱,需审批门禁 — tomchapin · 2026-10-03
- 研究者回应版权质疑:神经符号方法可绕开 fair use 争议 — examachine · 2026-10-03
- Reddit 热议:为何没有一家前沿厂商愿做低限制模型 — Dogbold · 2026-10-03