Anthropic:已拦截多起利用 AI 研发生化武器的企图
KoseteBamse · reddit · 2026-09-11
据 CNN 报道,Anthropic 发布报告称其拦截了可能的试图利用 Claude 模型获取生化武器开发相关能力的请求。这是 AI 公司公开披露的模型滥用拦截案例,显示前沿实验室正将生化安全风险评估纳入护栏体系。
「安全」频道最新
- Mozilla CTO 呼吁校园暂停生成式 AI:恐失去一代儿童 — Dan_Jeffries1 · 2026-09-11
- PuzzleMask 用普通英文绕过全部 4 个 LLM 门卫模型 — TechNadu · 2026-09-11
- AI API 安全守则:千万别把密钥硬编码进客户端 — eyishazyer · 2026-09-11
- 机场酒店 Wi-Fi 弹窗勿点:AI 安全系列提醒 — eyishazyer · 2026-09-11
- Enigma CTO:首起十亿美元 Agent 攻击或不是黑客袭击 — TechNadu · 2026-09-11
- BlackHC:当前模型 x-risk 低,但不改变路径几年内风险会大增 — BlackHC · 2026-09-11