DeepSeek-V4 Pro 击败 Sol 与 Fable

zainhas · x · 2026-08-15

在软件工程(DeepSWE)任务的头对头测试中,DeepSeek-V4 Pro 准确率达到 88.5%(pass@4),击败了 Fable 5 和 GPT 5.6 Sol。同时,其成本极具优势,单任务仅 $0.24,分别比 Sol 和 Fable 便宜 35 倍和 90 倍。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →