给 agent 配收件箱后实测:钓鱼链接一骗就中,四道工具层检查补漏

nikolasdimitroulakis · reddit · 2026-09-23

作者团队给 AI agent 开通了收件箱访问权限做测试,agent 完全按指令行事:读邮件、点开短链、总结页面——而那条链接指向一个伪造登录页。人类靠悬停看链接、检查发件人域名等视觉线索防钓鱼,agent 一概不做,而且比人更听话,连团队都是看了 trace 才发现问题。

他们在 agent 允许操作的链接前部署了四道按顺序执行的检查:

作者也承认盲区:被入侵的老域名合法账号发干净链接,这种「贵价攻击」任何检查清单都防不住,解法是不让 agent 在无人工确认时执行不可逆操作。两条经验:检查放在工具层而非 prompt(prompt 在压力下会被绕过,拒绝返回内容的工具绕不过);记录所有失败检查,封禁模式能反映 agent 正在被喂什么。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →