DeepSeek Flash v4网安实测:找回24个CVE,性价比仍逊于Luna

teortaxesTex · x · 2026-08-01

在最新的网络安全漏洞挖掘基准测试中,DeepSeek Flash v4 展现了强大的实力。测试结果显示,该模型在 32 个 CVE(通用漏洞披露)中成功找回了 24 个,pass@3 召回率达到了 75%。

然而,从成本效益的角度来看,DeepSeek 此次测试的花费为 150.22 美元。相比之下,Luna 模型在重新定价后的成本仅为 75.36 美元。尽管 DeepSeek 在能力上仅落后于 GPT-5.6-Sol 和 Kimi 1 个 CVE,但在帕累托最优前沿(能力与成本的综合平衡)上,Luna 依然凭借更低的价格和稳定性保持领先。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →