开源红队框架 DeepTeam:本地模拟越狱与注入攻击测 LLM
tom_doerr · x · 2026-09-19
DeepTeam 是一个开源的 LLM 红队测试框架(GitHub 2.8k star),相当于针对 LLM 系统的渗透测试工具。
它可在本地模拟越狱(jailbreak)、prompt 注入、多轮利用等攻击,帮你在 AI agent、RAG 管道和聊天机器人上线前发现偏见、PII 泄露、SQL 注入等漏洞,并提供生产环境护栏方案。
框架基于开源 LLM 评测框架 DeepEval 构建,由 Confident AI 维护,配套平台可用于管理风险评估与团队报告。
「编程与Agent」频道最新
- 用双 agent 分工省额度:一个写码一个测试 — ___Patrice___ · 2026-09-19
- onPanda 开源:token 级编辑 LLM 输出,可接管 Claude Code 等 harness — Fancy_Fanqi77 · 2026-09-19
- Muse 用例目录新增 90 个,总数达 678 个附即用提示词 — armand_ruiz · 2026-09-19
- 不等 waitlist:实测用 Vercel AI Gateway 跑通 Jev 评测接口 — AlchainHust · 2026-09-19
- 让 Sonnet 3.6 住进模拟世界:专设「善意地狱」训练 — repligate · 2026-09-19
- Anthropic Fable 5.1 登陆 Kiro,主打长程 Agent 会话不丢上下文 — DigitalColmer · 2026-09-19