微软发布 MAI-Cyber-1-Flash,称 CyberGym 成绩领先且成本减半
satyanadella · x · 2026-07-28
微软宣布推出 MAI-Cyber-1-Flash,这是其首个网络安全模型,并将其接入 MDASH 多智能体安全框架。
- 官方称,这套组合能在复杂代码库中发现高难漏洞,并以领先模型 50% 的成本实现“世界级”表现。
- 图中给出的 CyberGym 结果显示,MDASH: MAI-Cyber-1-Flash + GPT-5.4 的成功率达到 95.95%,高于 Gemini 3.5 Flash Cyber in CodeMender、GPT-5.5 Cyber、GPT-5.6 Sol 和 Mythos 5。
- 微软强调,这不是单一模型单打独斗,而是把模型、上下文/信号、工具、动作空间和 harness 分开,由专门代理协作完成攻击模拟、检测分流和修复处置。
所属事件:微软发布 MAI-Cyber-1-Flash 安全栈(11 条相关)→
「模型」频道最新
- 决策模型 Jev 接入 OM1,在 NVIDIA Isaac Sim 中驱动 Go2 机器人导航 — paigeinsf · 2026-09-23
- 网友辩称随机采样是智能必需:确定性模型或无法「思考」 — burny_tech · 2026-09-23
- 网友预测 2026 秋:Opus 5.5、GPT-6、Qwen4 同期登场 — IanAndrewsDC · 2026-09-23
- Cline 宣称 MiMo-v2.6-Pro 登顶开源权重模型榜 — burny_tech · 2026-09-23
- Anthropic 自嘲式官宣:Opus 5.5 远胜 Opus 5,网友戏称该向旧模型道歉 — repligate · 2026-09-23
- Opus 5.5 创作实测:「建议你把想要的都画出来」 — repligate · 2026-09-23