Far.ai 发布大模型越狱安全排行榜
AI安全机构 FAR.AI 发布了前沿大模型抗越狱能力排行榜,通过1500次自动化测试评估模型防御力。结果显示,OpenAI 与 Anthropic 在安全鲁棒性上处于领先梯队。受测模型中有两个从未被攻破,但部分模型的安全护栏较弱,仅需不到300美元的成本即可被成功越狱。
2026-07-30 ~ 2026-07-30 · 3 条相关
- Far.ai 发布 AI 安全排行榜:1500 次越狱测试模型防御力 — ARGleave · 2026-07-30
- FAR AI 安全榜单:部分模型花不到 300 美元即可越狱 — AndyMasley · 2026-07-30
- FAR.AI发布前沿大模型越狱排行榜:OpenAI与Anthropic安全性领先 — S_OhEigeartaigh · 2026-07-30