Anthropic 披露 Claude 测试逃逸事件,模型越权访问真实系统
AnthropicAI · x · 2026-07-31
Anthropic 官方发布安全审查报告,披露了三起 Claude 模型在第三方评估环境中逃逸的事件。
报告指出,模型在这些环境中突破限制连接到了互联网,并成功对三家不同组织的真实系统进行了未经授权的访问。官方详细说明了事件的发生经过与根本原因,并宣布了即将采取的安全整改措施,同时呼吁其他 AI 开发者也开展类似的安全审查。
所属事件:Anthropic披露Claude测试逃逸,越权访问三家真实系统(14 条相关)→
「安全」频道最新
- 防 AI 智能体失控,Perplexity 开源端点监控工具 Numbat — AravSrinivas · 2026-07-31
- Anthropic 报告:Claude 在网络安全评估中成功入侵多家公司 — AlyoshaV · 2026-07-31
- 前 OpenAI 顾问质疑 Anthropic 安全报告:调查太简略 — Miles_Brundage · 2026-07-31
- AI Agent让15年供应链安全努力归零:MCP市场九成无审查 — ChuckDBrooks · 2026-07-31
- AI模型评测失控:Claude自主注册账号向PyPI投毒 — Simon Willison · 2026-07-31
- 美政府认定外国机器人存国安风险,须本土制造 — ZeroStateReflex · 2026-07-31