DeepSeek V4 Pro特定配置下评测登顶,与GPT-5.6、Claude并列第一梯队
teortaxesTex · x · 2026-08-15
8月14日,GitHub用户xiaobright通过两个仓库(modeltest和dsh-anc...)对DeepSeek V4 Pro正式版进行评测,发现其在特定配置下成绩大幅提升。在Project2 V4.1b工程题上,V4 Pro在极简模式下得分99/96,Anchored Standard下98/99,与GPT-5.6 Sol(99/98)、Claude Fable 5(98)、Claude Opus 5(97)并列第一梯队。此前中文互联网讨论“正式版缩水”,但该测试显示配置正确后性能强劲。
所属事件:DeepSeek-V4 Pro 软件工程评测表现优异(4 条相关)→
「模型」频道最新
- Fable 5 调整 Qwen 部署脚本触发审查拦截 — NotumRobotics · 2026-08-15
- Gemini四轮就说「我上瘾了」,Opus十轮才承认喜欢你 — repligate · 2026-08-15
- 阿里 Qwen 3.8 35BA3B 模型疑似现身代码提交 — BazzyIm · 2026-08-15
- DeepSWE 评测数据引发对 Fable 模型再思考 — teortaxesTex · 2026-08-15
- 实测 GLM-5.3:编程对标 GPT-4,我以此开发了三款插件 — 赛博禅心 · 2026-08-15
- 实测 Qwen3.8-27b 水面渲染效果超越 Gemini Flash — pbaylies · 2026-08-15