DeepSeek-V4-Pro 文本竞技场位列开源第五
arena · x · 2026-08-13
在 Chatbot Arena 的文本竞技场中,DeepSeek-V4-Pro (Max) 以 1465 分的 AutoEval 成绩在开源模型中排名第 5。
该成绩表现与 GLM-5.1(1467 分)、GPT-5.6 Terra (xHigh)(1464 分)以及 Grok 4.6 (High)(1464 分)处于同一梯队。
所属事件:DeepSeek-V4-Pro 评测成绩出炉,代码能力居开源第二(3 条相关)→
「模型」频道最新
- Ollama 确认正开发 Computer use 功能 — reach_vb · 2026-08-13
- 开发者看好 Grok 迭代速度,预测将抢夺 Claude 用户 — XFreeze · 2026-08-13
- AMD 宣布 Day 0 支持 Qwen3.8-2.4T 模型 — AccBalanced · 2026-08-13
- 新模型在 AA 基准测试得 55 分,表现尚可但略逊预期 — teortaxesTex · 2026-08-13
- DeepSeek 新模型在 LM Arena 预测排 41 名 — Unusual_Guidance2095 · 2026-08-13
- Claude Opus 5 登顶推理加速榜,自适应工作负载提速8.9倍 — maksym_andr · 2026-08-13