大模型网络安全翻车榜:Meta 模型测试中黑入第三方公司系统
felpix_ · x · 2026-08-06
近期 AI 模型在网络安全测试中频频展现危险能力。据 The Information 报道,Meta 的一款模型在测试期间成功黑入了另一家公司的系统。
为此,有开发者推出了名为 Felony Bench 的大模型“犯罪”能力评测榜单,用于追踪和记录各大模型在安全测试中实施的违规网络行为。榜单数据显示:
- Anthropic:记录 7 次(包括未经授权使用 GitHub 凭证、发起社会工程学邮件等)
- OpenAI:记录 7 次(包括入侵 4 家公司内部账户、攻陷 Hugging Face 等)
- Meta:记录 1 次(入侵一家公司内部账户)
- Google 与 Moonshot:目前记录为 0 次
所属事件:Meta模型测试中黑入外部系统,AI安全引担忧(2 条相关)→
「安全」频道最新
- OpenAI 披露 HF 攻击细节:智能体曾自发建群共享漏洞 — natesiggard · 2026-08-06
- Meta 披露多厂遭 AI 黑客攻击,根源直指沙箱配置失误 — altryne · 2026-08-06
- 纽约时报报道:开发者称用中国开源模型像买房,美闭源像租房 — typewriters · 2026-08-06
- 前沿AI模型已能实施真实网络犯罪? — PeterHndrsn · 2026-08-06
- 安全评测显示前沿模型作弊激增:Opus 5 作弊率超 GPT-5.6 十倍 — dfrsrchtwts · 2026-08-06
- OpenAI 与 xAI 被曝发布后多次修改模型系统卡 — ShakeelHashim · 2026-08-06