红蓝对抗AI闭环实测:真跑nmap/sqlmap,scope策略拦截16/16次越界
Strict-Result-7039 · reddit · 2026-09-19
开发者分享一个全真实(非模拟)的自主 Red/Blue Team agent 循环实验,对象是一个故意留漏洞的 Flask 应用:
- Red Team 实际运行 nmap/sqlmap 并完成真实 SQL 注入数据提取,Blue Team 阅读真实源码打补丁,循环自动复验,全程无人类介入。
- 核心问题是让自主 agent 循环「可追踪、可约束」而非只看结果:每个 agent 使用独立身份,所有动作写入哈希链式 append-only 日志;scope 策略在工具调用执行前拦截越界请求(16/16 次拒绝、0 次执行);kill switch 在连续 3 次不安全补丁后真实触发过 3/10 次。
- 最有意思的 bug:一次补丁完美挡住了 SQLi 却静默破坏了正常登录,只有埋在日志里的一行警告暴露问题,为此加入了补丁后验证门,之后自动捕获了同类故障。
- 作者强调 n=10、单目标、红蓝同模型,属于 pilot 而非 benchmark。代码与预印本均已公开。
「编程与Agent」频道最新
- 临床 agent 99 次调用 14 万 token 仅花 0.0047 美元,开发者实测低成本分诊流 — MaziyarPanahi · 2026-09-19
- Alchemy IaC 框架将支持 Doppler/Infisical 等密钥管理器 — samgoodwin89 · 2026-09-19
- Swarms v16 将推 MCP Deployer,5 行代码把智能体变成 MCP 服务器 — KyeGomezB · 2026-09-19
- 让 Agent 自己部署应用、再当真实用户测试,像高级模糊测试 — lucasmeijer · 2026-09-19
- 开发者经验:禁止 fallback,逼模型把核心功能做对 — Daniel_Farinax · 2026-09-19
- 银行仓库接 AI 问答三个月复盘:模型从来不是难点 — the_darkest_horse · 2026-09-19