AI代理测试存在盲区 越权与隐私风险难检测

有文章指出,当前 AI Agent 测试工具多关注功能正确性(如回答准确度、工具调用),却忽视造成实际损害的危险行为,例如无故索要生日等敏感信息、泄露他人隐私、未授权推荐以及不可逆操作。目前这类问题主要依赖人工审查 Transcript,检测手段存在明显盲区。

2026-08-15 ~ 2026-08-15 · 2 条相关