DeepSeek V4.1 Flash 实测反超 V4 Pro:得分更高还更便宜
PawelHuryn · x · 2026-09-10
PawelHuryn 复测 DeepSeek 模型(effort=max)后发现 V4.1 Flash 明显优于 V4 Pro:
- DeepSeek V4 Pro(max):16/105 题,花费 $1.89,耗时 37 分钟
- DeepSeek V4.1 Flash(max):24/105 题,花费 $1.08,耗时 42.6 分钟
Flash 版本在得分高出 50% 的同时成本反而更低,作者据此更新结论:V4.1 Flash 是更优选择。
所属事件:Bug Hunt Bench 实测 105 个真实 Bug,DeepSeek V4.1 Flash 高性价比夺目(8 条相关)→
「模型」频道最新
- Cohere:North Small Translate 精通 50 多种语言,亚欧语系表现突出 — cohere · 2026-09-11
- Cohere 发布开源机器翻译模型 North Small Translate — cohere · 2026-09-11
- Agent 负载逼出架构革命:模型加速进化以大幅削减 KV 缓存 — appenz · 2026-09-11
- Grok Voice Think Fast 2.0 High 居语音对话模型榜首,难被超越 — XFreeze · 2026-09-11
- 新模型越来越顺从却不会反问,Astra/Fable 在 XY 问题上一塌糊涂 — teodorio · 2026-09-11
- 博主吐槽基准图表"造假":DeepSeek V4.1 得分竟低于 DeepSWE — teortaxesTex · 2026-09-11