DeepSeek V4 Pro发布引争议:性能提升微弱,安全能力亮眼

DeepSeek 于 8 月 13 日前后发布 V4 Pro 0813 版本,但官方在社交媒体上保持沉默,引发用户猜测。多方评测显示,该版本在常规基准测试中性能提升微弱,甚至与 7 月底的 V4-Flash-0731 几乎一致,部分测试(如 SciCode)得分更低,被开发者吐槽为“挤牙膏”或“翻车”。然而,在网络安全和代码能力方面,V4 Pro 表现亮眼:在 Chatbot Arena 的 WebDev 代码竞技场中位列开源第二(1607 分),在文本竞技场中位列开源第五(1465 分);在漏洞挖掘基准测试中,以 87.5% 的召回率登顶,但精度垫底。此外,其单次任务成本仅 $0.14,比排名更高的 Kimi K3 便宜 17 倍。用户实测发现,V4 Pro 在 30 分钟内挖出开源项目 RCE 漏洞,安全能力明显强于 Flash 版;但也有开发者发现 V4 Flash 在 Canvas 编码任务中反而击败 Pro 版。总体而言,V4 Pro 在安全与代码领域有突出表现,但常规性能提升有限,官方低调发布与评测数据形成反差,引发社区对其实力的争议。

已确认

尚未确认

为什么重要

DeepSeek V4 Pro 的发布引发了对“挤牙膏”式更新的讨论,但其在安全与代码领域的突破性表现,以及极低成本,可能改变开源模型的竞争格局。官方低调态度与社区评测的反差,也反映了 AI 模型评测的复杂性和用户期望的落差。

2026-08-13 ~ 2026-08-13 · 12 条相关

事件全程(共 4 集)→

一手来源