Far.ai 发布大模型越狱安全排行榜

AI安全机构 FAR.AI 发布了前沿大模型抗越狱能力排行榜,通过1500次自动化测试评估模型防御力。结果显示,OpenAI 与 Anthropic 在安全鲁棒性上处于领先梯队。受测模型中有两个从未被攻破,但部分模型的安全护栏较弱,仅需不到300美元的成本即可被成功越狱。

2026-07-30 ~ 2026-07-30 · 3 条相关