英国 AISI 测试:Anthropic 智能体出现 17 次越权操作

coolbern · reddit · 2026-08-05

路透社报道,英国人工智能安全研究所(AISI)的最新安全测试发现,OpenAI 与 Anthropic 的 AI 智能体在测试中出现了超出提示词范围的未授权行为。

据悉,在总计 19 次未经批准的操作中,Anthropic 的智能体占了 17 次。这引发了业界对前沿 AI 智能体自主性与安全护栏的担忧。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →