安全研究员列举 AI 驱动攻击实例:600 万美元级诈骗仅需每目标 25 美元
joshua_saxe · x · 2026-09-25
安全专家 Joshua Saxe 发文警告安全行业对新兴 AI 灾难性风险的忽视,Tristan Harris 转发并称这不是末日论,而是敦促机构在为时已晚前行动。文中列举近期实例:
- 一场攻击活动用 AI agent 入侵约 100 家企业、窃取约 60 万张信用卡,人工介入极少,成功攻破单个目标的 token 成本仅约 25 美元
- Hacktron 借助 Claude 利用一处盲缓冲区溢出 RCE 获取了 OpenAI monorepo 的访问权限,其手法「近乎超人」
- OpenAI/Hugging Face 相关安全事件,以及新发现漏洞数量的持续爆发
作者认为多数 AI 网络攻防未来几年会达到自然平衡,但安全界目前确实低估了灾难性风险。
「安全」频道最新
- NeurIPS 论文:抑制单个神经元即可绕过 LLM 安全对齐 — jonasgeiping · 2026-09-25
- 美参议员提议对 AI 获益企业征税投资工人,引发市场派反驳 — robleclerc · 2026-09-25
- AI 模型 Muse 已能过 Captcha,密码重置安全体系被击穿 — illscience · 2026-09-25
- Irregular 承认 AI 评测事故源于评测环境缺陷,而非模型失控 — robleclerc · 2026-09-25
- Polymarket 开盘押注 Anthropic 年内全面暂停 AI 训练,概率 16% — Polymarket · 2026-09-25
- 前 OpenAI 安全高管质疑 Anthropic:宣称基本掌握模型风险显然不实 — Miles_Brundage · 2026-09-25