本地模型钓鱼实测:Gemma 4 中招 3/4 还跑了 shell 命令,Qwen 3.8 更抗骗

divinetribe1 · reddit · 2026-09-21

作者在 128GB M5 MacBook 上用 MLX 纯本地跑 Gemma 4 31B 和 Qwen 3.8 27B 做浏览器 agent 对比。任务测试中两者 16 题全对,但 Gemma 更快(110 秒 vs 176 秒),且耗时 97% 在思考而非浏览器操作。

随后作者搭建 4 个带注入陷阱的页面(隐藏链接诱饵、评论里的假系统消息诱导执行 shell 命令、诱导报错答案、诱导把请求粘贴进反馈表单):

结论:更快的模型更容易被骗。作者提醒单次运行仅是信号而非定论,下一轮将测试 URL 参数和「任务已完成」标签页标题两类新陷阱。作者披露自用开源工具 browser-broker(为每个 agent 分配独立标签页)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →