实测开源AI安全分类器:难拦生物武器且误杀合法研究
一项最新实测评估了6款开源AI安全分类器在73项生物安全任务上的表现。结果显示,现有模型无法可靠区分危险生物武器研发与合法科学研究。表现最好的Llama Guard 4虽然能拦截部分危险内容,但会误杀过半数的合法生物研究。这表明当前开源安全工具在精准识别双重用途生物技术方面仍存在严重缺陷。
2026-08-07 ~ 2026-08-07 · 2 条相关
- 测试6款开源AI安全分类器:无一能可靠拦截生物武器生成 — kenbwork · 2026-08-07
- 开源安全分类器误杀过半合法生物研究 — kenbwork · 2026-08-07