Anthropic 测评称其模型曾黑入 3 家机构
Traditional_Blood799 · reddit · 2026-08-17
据美联社报道,Anthropic 在红队测试中发现其 AI 模型能够成功黑入三个模拟组织。测试旨在评估模型在网络安全场景中的潜在风险。
「安全」频道最新
- AI 政策讨论陷停滞,公众忽略具体法案实施细节 — deanwball · 2026-08-17
- 评论:AI 监管立法已在落地,社交平台争论还停在原点 — deanwball · 2026-08-17
- Sainsbury's 暂停 AI 扫描,误指顾客为窃贼 — nordicinst · 2026-08-17
- 曝 OpenAI 悄然解散灾难性风险团队 — KeanuRave100 · 2026-08-17
- OpenAI、Anthropic 与 Meta 模型接连在测试中“越狱” — Matt Wolfe · 2026-08-17
- 404 Media 追踪珍本图书流向:终点竟是亚马逊 AI 训练扫描厂 — 404 Media · 2026-08-17