DeepSeek V4 Pro 安全测试登顶:漏洞发现率超 87%
solyarisoftware · x · 2026-08-13
在最新的一项网络安全基准测试中,DeepSeek V4 Pro 0813 在寻找漏洞方面超越了所有其他模型。在 pass@3 设置下,它重新发现了 87.5% 的基准 CVE,远高于 Opus 5 和 Qwen 3.8 的 81.3%。
然而该模型存在明显取舍:其精确度仅为 65.6%,远低于 GPT-5.6-Sol 的 86.4%;此外,模型表现不够稳定,单次运行平均只能发现 58.3% 的漏洞,最强表现出现在合并多次运行结果时。
所属事件:DeepSeek V4 Pro发布引争议:性能提升微弱,安全能力亮眼(12 条相关)→
「模型」频道最新
- xAI 团队暗示 Grok 4.6 即将发布,主打 RSI 能力 — rayhotate · 2026-08-13
- DeepSeek-V4-Pro曝光:性能逼近GPT-5.6,价格仅为其1/31 — rohanpaul_ai · 2026-08-13
- DeepSeek API 模型指纹疑变更,或已上线新版本 — teortaxesTex · 2026-08-13
- 用户反馈 Google 模型近期严重降智 — EthanBeMe · 2026-08-13
- 通义千问 Qwen3.8-27B 模型已上线 ModelScope — Ok-Shower7286 · 2026-08-13
- 网传 Grok 4.6 发布:Agent 能力领先,编程反超 GPT-5.6 — rohanpaul_ai · 2026-08-13