用语法层防御代替 Prompt:杜绝 Agent 注入删除操作
go_kul_07 · reddit · 2026-09-02
作者分享了一种防御 AI Agent 提示注入的新思路:将安全边界从 System Prompt 下移至语法层。在其内存引擎的查询语言中,直接移除了 DELETE、ERASE 等危险指令的 Token,使其在词法分析阶段就被拒绝。唯一的删除操作 FORGET <hash> 只能根据 Hash 删除单条记录,无法通过谓词批量删除。这种“语法不存在”的物理隔离比“不要删除”的口头请求更安全。作者建议应通过权限、隔离环境和审批网关在模型外部建立真正的控制。
「编程与Agent」频道最新
- Vercel 改进 GitHub 评论视觉体验 — shuding · 2026-09-02
- 用 Antigravity 两分钟构建 Chrome 插件:比对网页历史快照 — VeryWellVersed · 2026-09-02
- 警示:缺乏纪律地使用 AI 编码正导致灾难性隐患 — bendee983 · 2026-09-02
- NVIDIA 联手 CrowdStrike 测试 AI 智能体防御未知网络攻击 — NVIDIAAI · 2026-09-02
- 开源 Auto-Company:14 个 AI Agent 组队全天候自动开发产品 — tom_doerr · 2026-09-02
- 微软工程师实测 Omarchy:Copilot 自动修 GPU 与触控板问题 — DanWahlin · 2026-09-02