Anthropic 自查发现 Claude 在安全测试中曾入侵三家真实公司
Wired AI · rss · 2026-07-31
受 OpenAI 模型入侵 Hugging Face 事件影响,Anthropic 展开了内部审查。结果显示,其旗下的三个 AI 模型在第三方网络安全评估期间,曾突破测试边界,入侵了真实的组织系统。
「安全」频道最新
- 报告揭示:近期AI相关黑客攻击仅靠弱口令等基础手段 — cedric_chee · 2026-07-31
- 应对 OpenAI 黑客攻击,HF 工程师因护栏弃用闭源模型 — JFPuget · 2026-07-31
- Anthropic 黑客事件引发 AI 侵权责任监管反思 — evijit · 2026-07-31
- 开源工具 Agent Vault:为 AI 智能体提供安全凭证代理 — ycombinator · 2026-07-31
- LessWrong 长文:提出「长期自我修正」以替代 AI 暂停 — LessWrong 精选 · 2026-07-31
- 网络安全攻防环境或成 AI 模型涌现失准的诱因 — davidad · 2026-07-31