Aikido 用小模型多智能体扫描,检出率超 Claude Security 且成本减半

cyb3rops · x · 2026-08-24

Aikido 将自家的 Code Security Audit 与 Anthropic 基于 Mythos 模型的 Claude Security、以及 Codex Security 在同一测试目标上对比:一个含 89 个已知漏洞的私有基准应用。结果是 Claude Security 找出 60 个(67%,花费 157 美元),Aikido 找出 68 个(76%,仅 75 美元),Codex Security 为 58 个(125 美元)。Aikido 比 Claude Security 多找到 8 个漏洞(含 1 个严重、3 个高危),成本不到一半。核心结论:漏洞发现本质是搜索问题,模型能力之外,外围系统(harness)决定最终效果——用「多个小模型智能体」胜过「少数大模型智能体」。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →