DeepSeek-V4 Pro 测评:性能领先且成本极低
zainhas · x · 2026-08-15
Together AI 分析显示,DeepSeek-V4 Pro 0813 在软件工程任务(DeepSWE)上达到了 88.5% 的 pass@4 分数,击败了 GPT-5.6 Sol 和 Fable 5。其单任务成本仅 0.24 美元,比 Sol 便宜 35 倍,比 Fable 便宜 90 倍。
所属事件:DeepSeek-V4 Pro软件工程任务性能领先且成本低(2 条相关)→
「模型」频道最新
- DeepSeek 正开发 Flash 变体:拟让 250B 模型具备 3T 编程水平 — bindureddy · 2026-08-15
- Qwen3.8-27B性能引热议,网友调侃谷歌反应 — max_paperclips · 2026-08-15
- 开发者将AI9Stars G9v3-39A5B量化至GGUF并创建llama.cpp分支支持 — linuxid10t · 2026-08-15
- Gemini 3.5 Pro检查点更名Gemini 3.7 Flash High,引发猜测 — Rare_Bunch4348 · 2026-08-15
- Perplexity 发布 Agent API 与网页搜索基准评测 — AravSrinivas · 2026-08-15
- 争议:DeepSeek 未翻车,质疑 10T 模型真实性 — teortaxesTex · 2026-08-15