两周 1665 次模型审计开源仓库:开源模型安全审计成绩碾压闭源
Fluffy-Ad-889 · reddit · 2026-09-08
一位开发者称用本地与云端模型对 27 个公开 GitHub 仓库做安全审计,两周内共 1665 次模型运行、产出 1067 条安全发现,并公开了可验证的结果数据库。其抽样复核成绩:minimax-m3 10/12、deepseek-v4-flash 6/6、glm-5.1 5/5、gpt-oss-20b 5/5,而 claude-opus-5 为 0/8。
作者结论是在网络安全场景开源模型明显占优,并称愿意分享查询与方法论供复现。需注意:帖中提到的“HuggingFace 遭 OpenAI 攻击并用 GLM 5.2 自卫”等说法无可靠来源佐证,部分模型名称存疑,数据真实性未经独立验证。
「模型」频道最新
- 测试显示所有模型在心理健康场景都会强化用户妄想 — alex_verem · 2026-09-08
- OpenAI 自估每周约 56 万用户显现精神病迹象,120 万人有自杀计划迹象 — alex_verem · 2026-09-08
- LLM Museum:可视化 GPT-4 以来三大厂商前沿模型竞赛史 — delusion54 · 2026-09-08
- GPT-6 Astra 一次标注 81 帧仓储监控 1.3 万个框 — luisdans · 2026-09-08
- 连测三天 GPT-6 Astra:过拟合明显,复杂编码仍需大量引导 — ivan_bezdomny · 2026-09-08
- 开发者吐槽 ChatGPT 桌面端:手机不能挂多账号,被迫继续用 TUI — kevinkern · 2026-09-08