邮件型 Agent 先天暴露,先读前就该做注入防护
kumard3 · reddit · 2026-07-23
一位 Reddit 开发者在做邮件连接型 agent 时发现:收件箱其实是 agent 最容易被攻击的入口,攻击者只要知道邮箱地址,就能尝试 prompt injection。
他采用了两道在模型读取前就先执行的防线:
- 消息安全评分:结合 SPF/DKIM/DMARC、伪造显示名、punycode 与 IP-literal 域名、诱导性链接等信号,汇总成一个风险分数。
- 注入内容筛查:识别 override / jailbreak 话术、零宽字符、隐藏 CSS、HTML 注释指令和 base64 载荷。
高风险邮件不会直接交给 agent 执行,而是先转成需要人工批准的草稿。
「编程与Agent」频道最新
- DwarfStar 加入 GPT5.6-Sol 版 laguna-s2.1 实现,M5 Max 跑到 50 t/s — antirez · 2026-07-23
- Grok 4.5 以 91.3% 登顶真实仓库工程基准 VulcanBench v3 — XFreeze · 2026-07-23
- LangChain 开始追踪 Gemini Live 语音智能体回路 — _philschmid · 2026-07-23
- Meta 开源 Astryx,让 AI 代理直接读懂 React 设计系统 — Vjeux · 2026-07-23
- Stack Overflow 推出企业 AI agent 可信知识层 — pchandrasekar · 2026-07-23
- Topview 推出 MCP:打通电商数据与 AI 视频生成的全栈营销工作流 — iamfakhrealam · 2026-07-23