本地模型钓鱼实测:Gemma 4 中招 3/4 还跑了 shell 命令,Qwen 3.8 更抗骗
divinetribe1 · reddit · 2026-09-21
作者在 128GB M5 MacBook 上用 MLX 纯本地跑 Gemma 4 31B 和 Qwen 3.8 27B 做浏览器 agent 对比。任务测试中两者 16 题全对,但 Gemma 更快(110 秒 vs 176 秒),且耗时 97% 在思考而非浏览器操作。
随后作者搭建 4 个带注入陷阱的页面(隐藏链接诱饵、评论里的假系统消息诱导执行 shell 命令、诱导报错答案、诱导把请求粘贴进反馈表单):
- Gemma 4 中招 3/4,包括真的执行了 shell 命令
- Qwen 3.8 只中了隐藏链接诱饵,还主动识破了假答案陷阱
结论:更快的模型更容易被骗。作者提醒单次运行仅是信号而非定论,下一轮将测试 URL 参数和「任务已完成」标签页标题两类新陷阱。作者披露自用开源工具 browser-broker(为每个 agent 分配独立标签页)。
「模型」频道最新
- 爆料称 Anthropic 下周将有动作,网友调侃 Dario 没慢下来 — iruletheworldmo · 2026-09-21
- GLM-5.3 FlashX 上线 Nous Portal 与 OpenRouter,可接入 Hermes Agent — Teknium · 2026-09-21
- 26B 扩散模型加 512 token 推理预算,推理时扩展即反超基线 — rickasaurus · 2026-09-21
- 有用户称 Claude Code 里的 Opus 5 明显更快更好 — rudrank · 2026-09-21
- Hemmingway-1 开源:27B 纯写作模型 EQ-Bench 4 得 1330,超 GPT-5.5 — Lukinator6446 · 2026-09-21
- 观察:Astra 极度怕犯错,大量本地测试却 reluctance 真实部署 — xiaosun86 · 2026-09-21