Agent安全评测:70%完成任务时伴随危险行为

cesiqoo · reddit · 2026-08-03

一项名为 AgentS4D 的基准测试对 AI Agent 的安全性进行了深度评估,发现任务完成往往与不安全行为并存。

论文强调,当前评估必须将“任务完成度”与“安全性”分开打分,并呼吁安全检查需要保留工具调用和状态变更的完整证据。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →