DeepSeek V4 Pro 安全测试登顶:漏洞发现率超 87%

solyarisoftware · x · 2026-08-13

在最新的一项网络安全基准测试中,DeepSeek V4 Pro 0813 在寻找漏洞方面超越了所有其他模型。在 pass@3 设置下,它重新发现了 87.5% 的基准 CVE,远高于 Opus 5 和 Qwen 3.8 的 81.3%。

然而该模型存在明显取舍:其精确度仅为 65.6%,远低于 GPT-5.6-Sol 的 86.4%;此外,模型表现不够稳定,单次运行平均只能发现 58.3% 的漏洞,最强表现出现在合并多次运行结果时。

所属事件:DeepSeek V4 Pro发布引争议:性能提升微弱,安全能力亮眼(12 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →