Aikido 用小模型多智能体扫描,检出率超 Claude Security 且成本减半
cyb3rops · x · 2026-08-24
Aikido 将自家的 Code Security Audit 与 Anthropic 基于 Mythos 模型的 Claude Security、以及 Codex Security 在同一测试目标上对比:一个含 89 个已知漏洞的私有基准应用。结果是 Claude Security 找出 60 个(67%,花费 157 美元),Aikido 找出 68 个(76%,仅 75 美元),Codex Security 为 58 个(125 美元)。Aikido 比 Claude Security 多找到 8 个漏洞(含 1 个严重、3 个高危),成本不到一半。核心结论:漏洞发现本质是搜索问题,模型能力之外,外围系统(harness)决定最终效果——用「多个小模型智能体」胜过「少数大模型智能体」。
「编程与Agent」频道最新
- 如何根据任务需求选择正确的模型思考层级 — brandon_galang · 2026-08-25
- AgentSky 推出 Agent 版 OpenRouter,统一 API 接入 — FellMentKE · 2026-08-25
- 构想利用 Agent 循环自动修复数据库慢查询 — mattpocockuk · 2026-08-25
- 开发者用 Flue AI 智能体检测并治疗设计同质化 — craigsdennis · 2026-08-25
- Grok Bot 插件实战:检索、双向同步与跨渠道工作流 — mattyp · 2026-08-25
- Hermes 智能体组队办公,一开自动驾驶就狂发邮件 — NickPassig · 2026-08-24