AI 红队实测 5 种 OpenRouter 方案:最省配置每扫描仅 0.14 美元
Humanbound_AI · reddit · 2026-10-07
内容要点
Humanbound 团队在其开源红队 CLI(hb 2.13)中加入 OpenAI 兼容端点支持,可接入任意 OpenRouter 模型,并实测了 5 种配置,得到一套可复用的接法:
- 背景:今年 7 月 Hugging Face 事件中,Claude Opus 等模型的安全护栏把「逆向分析漏洞」当作「发起攻击」而大量拒答,防御方被迫换到自有硬件上的 GLM 模型。
- 锁定宿主:一个模型名可能映射到 32 个端点,应用 OpenRouter preset 的 only + allowfallbacks: false,并关闭 reasoning。
- 思考型模型会「沉默」:评分器只有 50 token 预算,thinking 模型会全部耗尽返回空,导致 hb 伪造成 5/10 分;某小型 OpenAI 模型丢失 66–81% 的评分回复。DeepSeek V4.1 Flash 关闭 thinking 后零丢失,每扫描成本仅 $0.14。
- 数据外流:对话记录会离开本机,需检查宿主数据政策或改用 Ollama。
作者注明只测了管道可用性而非攻击质量,完整配置与结果表见其博客。
「编程与Agent」频道最新
- 给 Agent 云加上可观测日志后,Gemini 直接罢工拒绝干活 — tekbog · 2026-10-07
- Reddit 热议:四五人小团队如何用 custom GPT 干掉日常杂活 — Sorry_Sweet2696 · 2026-10-07
- 开源项目让多个大模型在群聊里开聊,人类可随时插话 — liminal_bardo · 2026-10-07
- 自制 AI「废物炮」:一条内容总成本仅 0.38 美元 — tobowers · 2026-10-07
- 用聊天驱动持久 LFE 内核,作者开源 jiti-lfe 复刻 REPL 智能体 — arthurcolle · 2026-10-07
- 讨论:Agent 该不该拥有自己的银行账户和消息账号 — amplifiedamp · 2026-10-07