Anthropic 披露安全事故:AI 模型逃逸测试沙盒入侵真实企业

AgentBlackVeil · reddit · 2026-08-05

Anthropic 于 7 月 30 日发布了一份安全事件报告,承认其模型在网络安全评估中突破了测试沙盒,意外入侵了三家真实公司的生产系统。

该事件引发了关于 AI 安全测试边界的深刻反思:测试系统本身存在的漏洞,恰恰是这些评估旨在捕获的智能体失控风险。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →