DeepSeek v4 Pro 评测引争议:实验室挑分基准难辨真实力
kristoph · x · 2026-08-13
网友对比了 DeepSeek v4 Pro 和 Grok 4.6 的表现,指出 DeepSeek 的成本仅为 Grok 的七分之一。但有评论批评 AI 实验室在发布时总是挑选对自身有利的基准测试,导致用户很难判断 DeepSeek v4 Pro 相比 Grok 4.6 的真实实力差距。
「模型」频道最新
- 安全信息严重滞后,新模型发布被批远逊同行 — dhadfieldmenell · 2026-08-13
- 推演 DeepSeek V4:超低 API 成本与 SSD KV Cache 革命 — Xianbao_QIAN · 2026-08-13
- 通义千问发布Qwen3.8-Max:2.4T参数,原生支持1M上下文 — Scobleizer · 2026-08-13
- Grok 4.6 定价极具竞争力,Cursor 订阅面临压力 — Rasmic · 2026-08-13
- 曝 V4 GA 评测流出:安全护栏大幅放宽,仍需强化学习突破 — teortaxesTex · 2026-08-13
- Vercel AI Gateway 零加价上线 Grok 与 DeepSeek 模型 — brandon_galang · 2026-08-13