Nyx 在 AgentHarm 上攻破率更高
ycombinator · x · 2026-07-20
Nyx 被介绍为“AI agents 的前沿黑客”。在 AgentHarm 基准上,它的攻击成功率达到 78%,高于 GPT-5.6 Sol 的 67%。原帖还附了线程,进一步解释它的工作方式。
「安全」频道最新
- OpenAI 认为长程模型要按完整行动序列做安全对齐检查 — rhiever · 2026-07-22
- 斯坦福 HAI 用 PNAS 特辑梳理生成式 AI 法律问题 — StanfordHAI · 2026-07-22
- 新型恶意软件潜伏盲区:专攻 AI 基础设施窃取数据 — Wired AI · 2026-07-22
- 生成式AI击碎中小企业安全防线:多语言钓鱼与高管声音克隆 — YvesMulkers · 2026-07-22
- 一篇面向架构师的云端 AI 治理指南 — bibryam · 2026-07-21
- OpenAI 支持马萨诸塞州前沿 AI 法案,呼吁加入独立审计 — ShakeelHashim · 2026-07-21