FAR AI 安全榜单:部分模型花不到 300 美元即可越狱
AndyMasley · x · 2026-07-30
FAR AI 发布了前沿 AI 模型安全排行榜,测试各模型的安全护栏强度。结果显示,在受测模型中有两个从未被攻破,但另外两个模型只需花费不到 300 美元的成本就能成功越狱,导致其毫无限制地提供大规模杀伤性武器的制造指导或黑客攻击协助。
「模型」频道最新
- DeepSeek 延迟发布 V4,坚持模型与工程框架协同优化 — teortaxesTex · 2026-07-30
- ThursdAI直播预告:探讨1.56TB的Kimi K3检查点 — altryne · 2026-07-30
- Kimi K3 递归自我改进 Cline,终端基准得分升至 88.8% — teortaxesTex · 2026-07-30
- 开发者痛批AI圈“造假”演示:Claude Opus神级表现实为夸大 — wavefnx · 2026-07-30
- OpenRouter 数据:Together 提供 Kimi K3 最低价与最高缓存命中率 — zhyncs42 · 2026-07-30
- 微软向华尔街展露野心:自研模型与工具全面对标 OpenAI — TechCrunch AI · 2026-07-30