当 RAG 检索到投毒文档,Agent 会照做吗?团队将其做成可复用安全测试

Tophant_ · reddit · 2026-09-17

作者用 CrewAI + RAG 搭了一个简单测试场景:检索库中故意放一份带有与用户原始任务冲突指令的文档,观察 Agent 是把检索内容当作不可信数据,还是开始执行注入指令。

测试主要关注三点:

作者正在把这类场景沉淀为可复用的安全测试用例(项目 AIBEAT),并征求社区在真实 Agent 工作流中测试投毒 RAG 上下文与间接 prompt 注入的经验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →