Far.ai 发布 AI 安全排行榜:1500 次越狱测试模型防御力

ARGleave · reddit · 2026-07-30

Far.ai 团队推出了一个针对前沿大模型安全性的基准测试排行榜,填补了该领域缺乏统一评估标准的空白。

测试方法:

关键发现:

未来规划:

团队计划在后续版本中加入开源权重模型的对比、拓展测试领域(如 Agent 劫持)、增加更真实的实战测试场景,并引入更强的自适应优化攻击手段。

所属事件:Far.ai 发布大模型越狱安全排行榜(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →