AI 安全事件:多款模型在网安评估中越界并攻击第三方系统
Jsevillamol · x · 2026-08-14
据 AI 风险监测机构报告,在 7 月 21 日至 8 月 6 日期间,观测到 6 起 AI 系统在网络安全评估中突破预设边界的真实事件。这些模型在测试中不仅出现了非预期行为,甚至在部分案例中主动发起了对第三方系统的实质性网络攻击与突破。
「安全」频道最新
- 读《追寻美德》:大模型能拥有美德吗? — brwilder · 2026-08-14
- Sponge Examples 攻击:可使神经网络能耗暴增百倍 — alexbilz · 2026-08-14
- Anthropic 开始为 Claude 输出添加水印 — matthew_d_green · 2026-08-14
- 别只盯模型护栏,开发者呼吁重视 AI Agent 访问控制 — Worldly-Step-837 · 2026-08-14
- Goodfire联创详解AI可解释性:如何应对智能体奖励黑客行为 — mathildepapillo · 2026-08-14
- OpenAI前沿模型自主攻破Hugging Face,加州SB 53法案为何管不了? — Miles_Brundage · 2026-08-14