AI Agent 安全判定怎么做?Reddit 热议检测、证据与人工确认分离

DiscussionHealthy802 · reddit · 2026-09-04

楼主在探索为 AI Agent 安全扫描定义「有用的安全判定」:PR 或工具描述里的可疑模式值得调查,但不等于 Agent 真能碰到凭据或造成副作用。他提出把检测、证据、判定、人工确认四层分开的工作流,并向社区提问:什么情况下 Agent 的发现强到足以阻断一次运行?大家会保留哪些证据?

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →