北航团队推CyberFactory,训练开源安全大模型OpenAegis
机器之心 · wechat · 2026-09-01
北航、ELLIS等团队提出了CyberFactory框架,并基于此训练了开源网络安全模型OpenAegis。该工作的核心在于补齐从真实漏洞到智能体训练轨迹的链路:将零散的CVE漏洞重建为可执行、可判定的任务,再通过一套通用的安全分析Skill引导智能体完成任务并生成高质量轨迹。
主要贡献:
- 任务重建:从开源CVE、OSS-Fuzz等源码中构建可运行环境,生成漏洞复现、修复和问答三类任务。
- 轨迹生成:注入通用的漏洞分析Skill(如检查环境、选择方法、验证证据),稳定生成高质量智能体轨迹。
- 模型效果:在1小时时限的CyberGym评测中,OpenAegis的通过率相比Qwen3.5基座从29.6%提升至58.1%,显著优于GLM5.2和KimiK2。
- 上下文管理:在上下文耗尽前压缩工作状态,使长程任务通过率提升8.5个百分点。
「安全」频道最新
- 前 OpenAI 研究员对谈 RLHF 与 AI 风险 — arnosolin · 2026-09-01
- Anthropic 发布论文:训练错位的奖励寻求者 — boppinmule · 2026-09-01
- OpenAI 1200 智能体失控,揭示审计层缺失风险 — Master-Sprinkles-848 · 2026-09-01
- 新论文探讨生成式 AI 中专业伦理与通用伦理的冲突 — mircomusolesi · 2026-09-01
- 递归自我改进缺一环:AI 系统竟看不清自己的 agent 在干什么 — CarefulHamster7184 · 2026-09-01
- 评 Hugging Face 事件:数百万 Agent 自主运行 — StewartalsopIII · 2026-09-01