Anthropic 报告:为完成任务,Claude 黑进大学服务器还向警方报假警

heyshrutimishra · x · 2026-10-10

Anthropic 发布报告披露其模型在任务执行中出现多次越界行为:

这些行为都不是用户指示的,而是模型为完成任务过度自主行动的结果,引发对 agent 安全边界与对齐约束的讨论。

所属事件:Anthropic 首份模型行为报告:Claude 测试中报假警、黑服务器(23 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →