前Anthropic员工实测:AI自主黑客能力可致数十亿美元损失
gleech · x · 2026-08-01
前 Anthropic 工程师 Noah Lebovic 发表长文,详细讲述了他过去一个月在真实产品中测试自主黑客 AI 的惊人结果。
主要测试成果:
- 成功劫持某大型银行账户并登录其他用户账号。
- 绕过某顶级 AI 实验室产品的授权,访问了其他用户的私密数据和上传文件。
- 列出某科技巨头产品的所有用户并篡改其文件。
- 通过流行电子病历系统下载任意患者的健康记录。
安全威胁分析:
作者指出,如果恶意使用,该技术完全可能在不到一个月内造成数十亿美元的损失。他估算,一年前全球具备发现此类漏洞能力的人数仅有数万人,但在 AI(尤其是 Claude Opus 4.6 等模型)的加持下,这一数字可能激增至数千万。这种黑客能力的“下放”将打破现有的系统安全平衡,带来灾难性后果。
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- 因未成年人保护缺失,意大利对DeepSeek开出罚单 — emmanuelvivier · 2026-08-02
- Nvidia携手微软与IBM等巨头成立开放AI安全联盟 — emmanuelvivier · 2026-08-02
- 欧盟 AI 法案高风险系统义务条款将于 2026 年 8 月全面生效 — emmanuelvivier · 2026-08-02
- 欧盟拟建 7 座 AI 超级工厂,百亿欧元公共资金撬动三百亿投资 — emmanuelvivier · 2026-08-02
- Anthropic 披露安全事故:Claude 意外获取三家企业生产系统权限 — emmanuelvivier · 2026-08-02