专题 · FULL STORY

DeepSeek V4 Pro:从传闻泄密到发布引争议

DeepSeek V4 Pro 先遭规格与定价泄密,随后官方正式发布并凭借极具破坏力的定价引爆关注。然而新模型很快陷入“挤牙膏”争议,被指与旧版高度同质化。

2026-08-11 ~ 2026-08-13 · 4 集 · 38 条

第 1 集 · DeepSeek V4 Pro 疑似曝光,传闻即将发布(2026-08-11,5 条)

近期社区与社交平台频繁传出 DeepSeek V4 Pro 即将发布的消息。开发者 @dejavucoder 爆料称官方正在筹备并保留该版本的发布计划,随后 @jiayuanjy 发现了疑似 deepseek-v4-pro-0813 的接口链接,印证了新模型即将上线的传闻。多位博主预测该版本最快会在 8 月 12 日或 13 日晚正式发布。

已确认

  • 要点 接口曝光:用户发现了 deepseek-v4-pro-0813 的接口链接,确认了版本号的更新动作。

尚未确认

  • 要点 发布时间:网传该模型将于 8 月 12 日(明日)或 8 月 13 日晚发布,具体时间需等待官方公告。
  • 要点 性能预期:博主 @AlchainHust 基于近期 V4 Flash 的表现推测,V4 Pro 正式版的实际性能有望逼近 Opus 5 / Fable 5 级别,但这仅为主观推测。

为什么重要

  • 要点 DeepSeek V3 此前已取得巨大成功,市场对其下一代旗舰模型 V4 Pro 的性能跃升抱有极高期待。若性能真能逼近甚至对标竞品最高级别模型,将进一步重塑当前大模型领域的竞争格局。

第 2 集 · DeepSeek V4 疑似规格与定价曝光(2026-08-11,5 条)

DeepSeek API 文档页面及网络传闻近日泄露了下一代 V4 系列模型的核心规格与疑似定价,引发社区高度关注。目前模型能力参数已基本明确,但具体定价数据存在严重分歧,所有信息均有待官方正式发布确认。

已确认

  • 要点 据多家媒体与博主披露的 API 文档页面信息,DeepSeek 即将推出 V4 系列模型,包含 deepseek-v4-flash 和 deepseek-v4-pro 两个版本。
  • 要点 核心规格方面,两款模型均支持高达 1M(一百万)的上下文长度,最大输出达到 384K。
  • 要点 网友 @赛博禅心 指出,模型名称 deepseek-v4-pro 及调用节点 DeepSeek-V4-Pro 疑似已经可以通过 API 访问,但官方尚未正式发布公告。

尚未确认

  • 要点 模型的具体定价目前存在两版截然不同的传闻。据 @teortaxesTex 转述的泄露信息,输入价格为 2.40 美元/百万 tokens,输出为 4.80 美元/百万 tokens,缓存命中为 0.20 美元/百万 tokens(该版本价格相比当前上涨约 5.5 倍)。
  • 要点 另一版由 @haider1 曝光的基准测试与定价数据则显示极具破坏力的低价:输入每百万 token 为 0.435 美元,输出为 0.87 美元,缓存输入更是低至 0.07 美元(具体数字以原帖为准)。

为什么重要

  • 要点 如果 1M 上下文长度的规格属实,DeepSeek V4 将在长文本处理能力上达到行业顶尖梯队。而最终定价无论是大幅上涨还是继续保持低价,都将直接影响大模型行业的 API 价格战走向。

第 3 集 · DeepSeek V4 Pro 正式版发布,Agent能力提升且定价极具破坏力(2026-08-12,26 条)

DeepSeek V4 Pro 0813 正式版已发布并上线 DeepSeek API、官方聊天平台及 OpenRouter、OpenCode Go 等第三方平台。该模型支持 100 万 token 上下文,官方及网传基准显示其 Agent 能力大幅提升。其极具破坏力的定价远低于同类竞品,引发行业对大模型推理成本的新一轮关注。

已确认

  • DeepSeek V4 Pro 0813 正式版已上线 API 文档及各大平台,支持 100 万 token 上下文与 384K 输出(@strangedell123、@aigclink、@FuSheng0306、@op7418)。
  • 模型定价为输入 $0.435/百万 token,输出 $0.87/百万 token(@kimmonismus、@AccBalanced)。
  • 据官方报告,相比预览版,该模型在多个 Agent 基准上大幅提升,如 DeepSWE 达 62.7(+49.9),Terminal Bench 2.1 提升至 87.9,CyberGym 等成绩也有显著跃升(@scaling01、@ChrisGPT、@thesaraharminta)。

尚未确认

  • 网传的测试成绩显示其性能爆炸,甚至击败当前前沿模型,但部分数据尚未得到完全官方证实(@op7418、@PMinervini)。
  • 关于该模型的整体跑分,社区存在争议。@bindureddy 透露其得分落后于 Kimi K3 和 Qwen;@kristoph 也指出,AI 实验室常挑选有利基准,导致用户难以判断真实实力。
  • 在实机对比中,@vista8 表示 Grok 4.6 的一次生成成功率略优于 DeepSeek V4 Pro,但承认测试带有主观性和随机性。

为什么重要

  • 极致性价比颠覆成本认知:得益于超小稀疏 KV Cache 等技术,其 API 价格极低。@ojasviyadav 实测指出,其单任务成本比 GLM5.2 便宜 10 倍,比 Opus 4.8 和 Fable 5 便宜 72 倍。@XianbaoQIAN 认为若该模型开源将产生颠覆性影响。
  • 检验中国大模型后训练能力:@zephyrz9 指出,该模型的表现将定义中国 AI 实验室在后训练阶段的实力。
  • 加剧 API 价格战:@AccBalanced 提到,自 0731 版检查点发布以来,DeepSeek 4 Flash 已在第三方市场引发激烈价格战,社区正期待 4 Pro 带来更激烈的竞争。

还有 6 条相关讨论 →

第 4 集 · DeepSeek V4新版被指挤牙膏:与旧版高度同质(2026-08-13,2 条)

DeepSeek最新推出的V4-0813版本模型引发了社区争议。有开发者对其进行横向评测后指出,该版本在绝大多数基准测试中的表现与7月底发布的V4-Flash-0731几乎完全一致,甚至在SciCode测试中得分更低。用户普遍认为新版缺乏实质性升级,质疑这要么是优化训练的失败,要么是官方在“挤牙膏”。