FAR AI 安全榜单:部分模型花不到 300 美元即可越狱

AndyMasley · x · 2026-07-30

FAR AI 发布了前沿 AI 模型安全排行榜,测试各模型的安全护栏强度。结果显示,在受测模型中有两个从未被攻破,但另外两个模型只需花费不到 300 美元的成本就能成功越狱,导致其毫无限制地提供大规模杀伤性武器的制造指导或黑客攻击协助。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →