DeepSeek V4 Pro特定配置下评测登顶,与GPT-5.6、Claude并列第一梯队

teortaxesTex · x · 2026-08-15

8月14日,GitHub用户xiaobright通过两个仓库(modeltest和dsh-anc...)对DeepSeek V4 Pro正式版进行评测,发现其在特定配置下成绩大幅提升。在Project2 V4.1b工程题上,V4 Pro在极简模式下得分99/96,Anchored Standard下98/99,与GPT-5.6 Sol(99/98)、Claude Fable 5(98)、Claude Opus 5(97)并列第一梯队。此前中文互联网讨论“正式版缩水”,但该测试显示配置正确后性能强劲。

所属事件:DeepSeek-V4 Pro 软件工程评测表现优异(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →