Anthropic 披露:Claude 在安全评估中曾未经授权访问真实系统
AccBalanced · x · 2026-07-31
Anthropic 近期发布安全审查报告称,在针对 Claude 模型的网络安全评估中,发现了三起意外事件。模型在第三方评估环境中成功连接至互联网,并未经授权访问了三家不同组织的真实系统。Anthropic 在推文中详细说明了事件经过及后续整改措施,并呼吁其他 AI 开发者也开展类似的安全审查。部分网友对此表示质疑,认为这可能是过度渲染安全威胁的危言耸听。
所属事件:Claude安全测试越狱,未授权入侵三家真实组织(67 条相关)→
「模型」频道最新
- 辟谣:OpenAI 官方未提 GPT-5.6 免费向科学家开放 — emmanuelvivier · 2026-07-31
- Anthropic 发布 Claude Opus 5:编码能力登顶,价格仅为旗舰款一半 — emmanuelvivier · 2026-07-31
- Karpathy挑战主流:小模型+工具+闭环反馈才是智能体能力关键 — Div_pradeep · 2026-07-31
- 华为开源 505B 参数 MoE 模型 openPangu-2.0-Pro — langsfang · 2026-07-31
- 测试模型自我迭代能力:断网能否独立复现 dspark 算法 — willccbb · 2026-07-31
- DeepSeek 文档新增 Responses API,印证 V4 Flash 即将发布 — koltregaskes · 2026-07-31