微软MDASH网安系统登顶,5B小模型扛九成任务
新智元 · wechat · 2026-08-02
微软多智能体安全系统 MDASH 在 CyberGym 网络安全基准中取得 95.95% 的漏洞复现率,断层领先众多前沿模型,且成本仅为此前最强配置的一半。
核心机制与亮点:
- 小模型打主攻:微软首发自研网安模型 MAI-Cyber-1-Flash(总参数 137B,激活参数仅 5B),负责处理高达 90% 的常规查询,最难的 10% 才交由 GPT-5.4 等大模型收尾,极大优化了推理成本。
- 多智能体编排:高分并非依赖单一模型,而是靠系统内 100 多个专用智能体协同完成(审代码、验漏洞、辩论真伪、写 PoC 等)。
- 数据壁垒:微软称其掌握超 100 万亿安全信号与 160 万家客户数据,这是竞争对手难以复制的护城河。
行业趋势:
网络安全正从“安全 Copilot”转向“安全行动系统”。同日公布的更大系统 Project Perception 采用红、蓝、绿三队智能体闭环,自主完成发现、判断与修复,将于 8 月 3 日公开预览。
「编程与Agent」频道最新
- Plannator 发布技能:用 HTML 生成 Agent 交互原型 — tom_doerr · 2026-08-24
- DocketBird MCP 服务器:支持搜索下载法院文档 — modelcontextprotocol · 2026-08-24
- AgentLux MCP 服务器:支持市场和社交流程 — modelcontextprotocol · 2026-08-24
- MongoDB 发布 Agent 工具包,让编码助手精通数据库 — TheTuringPost · 2026-08-24
- 开发软件前先让 Agent 查开源库,99% 的情况是正解 — generativist · 2026-08-24
- 开发者瓶颈不在 AI 上下文,而在人脑认知负荷 — Vidhrohi · 2026-08-24