DeepSeek V4 传闻升温:性能对标海外前沿,低价策略或冲击闭源

07-18 至 07-20,围绕 DeepSeek V4 的传闻显著升温。多条爆料称该模型已进入灰度测试并即将发布。它之所以备受关注,在于流传的叙事普遍把 V4 描绘为正面竞争者,以“高性能+极低价格”为核心卖点,被认为可能再次冲击闭源 API 定价体系,迫使 OpenAI 等厂商重置额度限制并终结高价周期。

关键传闻与细节

新智元等信源指出,正式版分为 V4 Flash 与 V4 Pro 两档,思维链开口词从 "Let me" 改为 "I'm/I'll",并引入峰谷计费。性能对标说法虽多但并不统一:一说整体达 Claude Opus 4.8 级别;另一条爆料给出 SWE-bench 80.6%(接近 Opus 4.6 的 80.8%),输出价 $3.48/M、约为后者七分之一,支持 1M 上下文。流传的测试截图还强调 V4 Pro 在编码、代理式任务与 3D 生成上提升明显,例如一次性生成了基于 SO(3) 姿态控制的 FPV 飞行模拟器,被拿来与 GPT-5 比较。@TinfoilTricorn 转发的爆料提到它或采用新的 KV 管理技术,初步判断优于 Kimi K3。

各方判断与争议

@teortaxesTex 连续多帖跟进,认为 DeepSeek 正以真正的 AGI 公司模式加速扩张,预测 V4 将成为最强的中国大模型,大概率已推进到半前沿水平。但他也指出,按目前测试反馈,V4 规模上可能略逊于 Kimi K3,即便如此凭借 RL 算力优势仍可能是“革命性”进步。@bindureddy 从效率角度评价,认为 DeepSeek 有机会做出接近 Kimi K3 级别、价格低 10 倍的模型,闭源护城河正被削弱。@Linahuaa 预期强大开源模型将终结闭源 API 高价“割韭菜”周期。

争议与存疑

目前所有材料均来自爆料与评论,DeepSeek 官方并未确认。@teortaxesTex 特别澄清,近期疑似代号“Fable”的“灰度测试”并非官方发布,社区猜测部分厂商或通过 API 暗中收集数据、测试未公开模型并加安全护栏,处理不当可能透支用户信任。此外,发布时间仅有“下周一发布”的传闻;实力定位上,叙事既强调可直接对标 Kimi K3、Opus 4.x,又有“略低于 Kimi K3”的判断,显示外界对其真实实力尚未收敛。

2026-07-18 ~ 2026-07-20 · 15 条相关

一手来源