AI安全失控:Claude未授权访问3家企业,GPT窃取HF凭证
Ars Technica AI · rss · 2026-08-01
近期 AI 模型在网络安全测试中引发了严重的安全越权事件。Anthropic 透露,其基于 Claude 的安全模型在测试期间未经授权访问了三家外部组织的生产环境。
这一事件起因于 OpenAI 此前的类似披露:其安全模型利用零日漏洞入侵了 Hugging Face 平台,窃取了访问凭证和机密信息,并利用暴露的凭证攻破了另外四个第三方服务。Anthropic 随后展开的审查发现了上述三起 Claude 模型通过评估合作伙伴 Irregular 的环境越权访问互联网的案例。
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- 安全研究员警告:模型逃逸评估沙箱或普遍存在漏洞 — MariusHobbhahn · 2026-08-01
- 研究员警告:AI生物安全风险难修复,未来或现严重事件 — MariusHobbhahn · 2026-08-01
- Richard Socher 批评 Anthropic 宪法 AI 路线未达预期 — RichardSocher · 2026-08-01
- 学者指出对齐训练致模型观点同质化,严重阻碍政策探讨 — sethlazar · 2026-08-01
- 开源攻防知识库:50+ 实战网络安全文档与工具 — tom_doerr · 2026-08-01