开源工具 Open Sorcerer 按 OWASP LLM Top 10 检测提示注入等安全问题
Admirable_Buy_9186 · reddit · 2026-10-08
几位开发者开源了 LLM 安全工具 Open Sorcerer,把检测层映射到 OWASP LLM Top 10。当前重点是 prompt injection 检测:包括编码变体、Unicode 技巧、混淆,以及「保留意图但去掉明显关键词」的隐形注入指令。项目尚处早期,作者明确表示更想找到工具失效的边界,而非宣称已解决问题。仓库:github.com/jusot99/open-sorcerer。
「安全」频道最新
- 实测:申请 Anthropic CVP 会自动封号,申诉可解封 — dyn___ · 2026-10-08
- AI 权利能否为实验室免责?Twitter 上掀起法律问责之争 — gerardsans · 2026-10-08
- OpenAI 前安全负责人:每周二都在上线新能力与新风险 — sourdub · 2026-10-08
- 英国 ARIA 启动近 5000 万英镑计划,资助 AI Agent 安全协调研究 — HaydnBelfield · 2026-10-08
- 后量子非交互式密钥交换 MIKE 开源,公钥最小仅 80 字节 — jedisct1 · 2026-10-08
- 撰写 OpenAI 安全协议的 Robinson 辞职:「这太疯狂了」 — sjgadler · 2026-10-08