编码 agent 要不要在工具结果入上下文前做注入扫描?
PatronusProtect · reddit · 2026-09-09
Patronus 团队在 Reddit 提出架构设想:编码 agent 每天吞入大量不可信输入(cloned repo、README、issue 文本、网页、MCP 响应、shell 输出),却通常直接进入模型上下文。他们提议在工具结果与上下文之间插入一个安全 hook:
- tool result → 本地运行的语义威胁/注入扫描器 → agent 上下文
- 本地能力不足时可回退到免费额度的 API
- 发现可疑段落时只 redact 该段,而非丢弃整个结果
- 下一步计划跨多次工具调用维护安全上下文,而非每次孤立扫描
团队正在征求反馈:是否会作为 Codex 插件安装?误报率与延迟的容忍阈值是多少?多加一层是否会弊大于利?
「编程与Agent」频道最新
- Box 发布 Mount:把 Box 文件夹挂载进 agent 沙盒双向同步 — badphilosopher · 2026-09-09
- Anthropic 专访三家初创:如何在 Claude Managed Agents 上做产品 — ClaudeDevs · 2026-09-09
- 用 ChatGPT Sites 给 agent 项目当进度日志,一举三得 — jdjohnson · 2026-09-09
- 实测者盛赞 Muse:给普通人用的 agentic AI,UI 胜过两大厂 — neil_chilson · 2026-09-09
- 远程 MCP 服务让 Claude、GPT、Grok 等多模型互辩互评 — modelcontextprotocol · 2026-09-09
- Anaconda 工程副总裁:Agent 不能同时碰内部数据和对外通信 — anacondainc · 2026-09-09