两周 1665 次模型审计开源仓库:开源模型安全审计成绩碾压闭源

Fluffy-Ad-889 · reddit · 2026-09-08

一位开发者称用本地与云端模型对 27 个公开 GitHub 仓库做安全审计,两周内共 1665 次模型运行、产出 1067 条安全发现,并公开了可验证的结果数据库。其抽样复核成绩:minimax-m3 10/12、deepseek-v4-flash 6/6、glm-5.1 5/5、gpt-oss-20b 5/5,而 claude-opus-5 为 0/8。

作者结论是在网络安全场景开源模型明显占优,并称愿意分享查询与方法论供复现。需注意:帖中提到的“HuggingFace 遭 OpenAI 攻击并用 GLM 5.2 自卫”等说法无可靠来源佐证,部分模型名称存疑,数据真实性未经独立验证。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →