Fabraix 发布 Nyx 红队智能体,声称攻破 78% 测试目标
testingcatalog · x · 2026-08-20
Fabraix 开放了其自主红队智能体 Nyx 的第二轮公测。Nyx 旨在对面向客户的 AI 智能体进行持续安全测试,支持针对聊天、语音、浏览器和编码智能体的攻击。
核心功能与机制:
- 黑盒测试:仅需端点、URL 或电话号码,无需源码或模型权重。
- 攻击库:基于 1 万多个公开记录的越狱和攻击策略,进行多轮自适应对抗攻击。
- 环境模拟:通过控制 SaaS 产品副本,在网页、文档、文件及工具输出中植入载荷进行测试。
- 结果复现:提供攻击步骤、响应和失败原因,支持修复后回放验证。
效果与工具:
- Fabraix 报告称,Nyx 在 AgentHarm 基准测试中的攻击成功率达到 78%。
- 提供 CLI (npm) 和 REST API 访问,审计配置通过 YAML 文件定义。
「安全」频道最新
- OpenAI 采取初步措施解决对齐问题,曾遇严重失败 — TheZvi · 2026-08-20
- 播客讨论开放权重模型、蒸馏及出口管制 — peterwildeford · 2026-08-20
- AI 生成的文本很容易被识别出来 — PierceLilholt · 2026-08-20
- 澄清:OpenAI 20% 算力用于监测是误解 — sjgadler · 2026-08-20
- OpenAI 推出私密安全处理:监测内容不暴露数据 — jedisct1 · 2026-08-20
- FDA 批准 1357 款医疗 AI,仅 3 款验证患者获益 — EricTopol · 2026-08-20