DeepSeek V4 Pro 评测遇冷:体积大 5 倍但分数仅微弱领先
scaling01 · x · 2026-08-13
近日有评测数据显示,DeepSeek V4 Pro 在 Artificial Analysis 基准测试中表现不及预期。
- 性能对比:该模型相比 Flash 版本体积大了约 5 倍,但得分仅高出 1 分,被指“性价比极低”。
- 社区观点:原推文作者直言“DeepSeek is washed(不行了)”,但也补充肯定了其蒸馏技术的表现依然不错。
所属事件:DeepSeek V4 Pro 疑似发错版下架,常规跑分平庸但网安能力亮眼(17 条相关)→
「模型」频道最新
- OpenAI预览GPT-5.6 Sol超快模式,速度提升14倍 — threepointone · 2026-08-14
- Opus 5 每小时成本超伦敦开发者时薪,引发热议 — kylegawley · 2026-08-14
- Gemini 3.7 Flash vs Opus 5 vs Grok 4.6 vs Kimi K3:同一草图生成四款不同汽车 — CodeByPoonam · 2026-08-14
- Qwen3.8-27B 模型卡上线,基准测试待发布 — -Cubie- · 2026-08-14
- 用户实测Gemini在游戏攻略中频频出错,感叹AI仍处早期 — JaxUK89 · 2026-08-14
- 曝苹果联手阿里自研中国专属大模型,罕见跨境合作 — The Verge AI · 2026-08-14