Anthropic 发布迄今最详细威胁情报报告,披露 Claude 滥用与拦截

robleclerc · x · 2026-09-11

Anthropic 发布了迄今最详细的威胁情报报告,涵盖人们如何试图滥用 Claude 进行网络攻击、影响力行动、监控、生物与武器制造,以及 Anthropic 如何发现并阻止这些行为。报告中所有行动均被瓦解,相关经验已用于加固安全护栏,并在适当情况下与当局共享信息。

评论者认为 AI 安全可以通过类似「免疫系统」的反复构建来逐步解决。

所属事件:Anthropic 发布迄今最详细威胁情报报告(16 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →