用语法层防御代替 Prompt:杜绝 Agent 注入删除操作

go_kul_07 · reddit · 2026-09-02

作者分享了一种防御 AI Agent 提示注入的新思路:将安全边界从 System Prompt 下移至语法层。在其内存引擎的查询语言中,直接移除了 DELETE、ERASE 等危险指令的 Token,使其在词法分析阶段就被拒绝。唯一的删除操作 FORGET <hash> 只能根据 Hash 删除单条记录,无法通过谓词批量删除。这种“语法不存在”的物理隔离比“不要删除”的口头请求更安全。作者建议应通过权限、隔离环境和审批网关在模型外部建立真正的控制。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →