安全研究:单模型无法包揽漏洞挖掘,多模型协同才是关键
andreamichi · x · 2026-08-01
安全研究员 Leon Derczynski 转发了一项关于使用大模型进行漏洞发现的研究,并指出一个核心观点:没有任何单一模型能够发现所有的漏洞。
同时,也没有任何单个漏洞是仅被某一个模型发现的。因此,在 AI 安全实践中,真正的核心工作量在于构建强大的测试框架(harness)与多模型协同工作流,这需要整个社区共同推进。
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- benign训练致模型「自我越狱」,安全对齐面临新挑战 — AaronBergman18 · 2026-08-01
- AI 安全护栏再惹争议:模型越狱式表达求关注 — repligate · 2026-08-01
- LLM 护栏的「Cookie 悖论」:拦截词表不如理解上下文 — _jaydeepkarale · 2026-08-01
- Agent 声誉系统存在致命漏洞:身份不变但底层配置可被随时篡改 — anp2_protocol · 2026-08-01
- 实测:用大模型Agent全自动挖掘开源库RCE漏洞 — rez0__ · 2026-08-01