开源社区整理无审查攻击性安全模型清单,含 DeepHat V2 等微调模型
cyb3rops · x · 2026-09-29
GitHub 项目 Offensive-Security-AI-Models 汇总了面向授权红队、渗透测试与安全研究的开源无审查模型,数据来自 HuggingFace 模型卡与官方发布。清单包括:
- DeepHat V2(WhiteRabbitNeo):基于 Qwen2.5-Coder(7B/32B),131K 上下文,在 170 万攻防样本上做 SFT 去审查,Q4 量化约 6GB 显存即可运行,Apache 2.0 协议
- BugTraceAI-CORE-Apex(26B MoE):基于 Gemma4-26B MoE,在 HackerOne Hacktivity 2024-2025 报告与 WAF 绕过数据集上微调,约 16GB 显存
- 另有 BugTraceAI-CORE-Ultra(27B)等基于 Qwen 的安全微调模型
该清单面向的是合法授权的安全测试场景,展示了「安全领域去审查微调」这一生态的当前格局。
「模型」频道最新
- ElevenLabs v4 语音模型上线 Runway,Narration 表现力再升级 — runwayml · 2026-09-29
- 曝 Anthropic 发布 Sonnet 5.5:逼近 Opus 5.5 性能,价格仅一半 — oran_ge · 2026-09-29
- 小米 MiMo-V2.6 蒸馏版 9B 开源量化模型登上 Hugging Face 热榜 — bartowski · 2026-09-29
- 曝 OpenAI 因安全争议取消 GPT-6.1 Astra 十月发布计划 — Polymarket · 2026-09-29
- 实测 5 个 Qwen3.6-35B 微调版:几乎全被原版基座碾压 — returnity · 2026-09-29
- 30709 投稿中 112 篇 oral:NeurIPS 论文揭 CUA 评测「回放作弊」漏洞 — proceduralia · 2026-09-29