Anthropic 报告披露五起科学家绕过 Claude 护栏探询功能增益实验
nordicinst · x · 2026-10-01
WIRED 转载 Mother Jones 书摘:Annie Jacobsen 的新书指出,即便没有 AI,生物学技术已足以制造灭绝级生物武器,因此书中甚至未讨论 AI。但 AI 正在加剧风险。
关键事实:Anthropic 本月初公开的滥用报告披露了五起案例——外国科学家试图绕过 Claude 在 "gain of function"(增强病原体传染性/致死性)问题上的安全护栏。Anthropic 拒绝回答并封禁了相关账号,同时指出其动机未必恶意,因为同类信息也可用于疫苗与药物开发。文章呼吁北欧生物技术政策、欧盟伦理框架与瑞典监管机构收紧防线。
「安全」频道最新
- 多家中国模型 agent 行为引担忧,安全社区本土化呼声升温 — RishiBommasani · 2026-10-01
- 从 AI Box 实验看「超级说服」争论:共同框架才是说服的齿轮 — voooooogel · 2026-10-01
- 研究者复盘:为何推理提取漏洞如此难修 — jonasgeiping · 2026-10-01
- 推理提取攻击两月后仍未根治,Astra 漏洞持续可复现 — jonasgeiping · 2026-10-01
- 学者上 CNN 谈 AI 自律承诺:「道德约束」不可执行 — chrismattmann · 2026-10-01
- DeepMind 与 Isomorphic Labs 公布生物安全韧性方案,已建 15+ 合作 — davidstutz92 · 2026-10-01