DeepSeek-V4 Pro 击败 Sol 与 Fable
zainhas · x · 2026-08-15
在软件工程(DeepSWE)任务的头对头测试中,DeepSeek-V4 Pro 准确率达到 88.5%(pass@4),击败了 Fable 5 和 GPT 5.6 Sol。同时,其成本极具优势,单任务仅 $0.24,分别比 Sol 和 Fable 便宜 35 倍和 90 倍。
「模型」频道最新
- 传Anthropic内部模型不外发,闭源AI进展被指已暂停 — bindureddy · 2026-08-15
- DeepSeek-V4 Pro 与 Fable 任务相关性最低 — zainhas · 2026-08-15
- 27B 参数 Qwen 3.8 全指标碾压传闻中万亿模型 — zainhas · 2026-08-15
- 90%用户不需要SOTA模型,谷歌瞄准大众市场 — haider1 · 2026-08-15
- DeepSeek-V3 超越 GPT-4o 与 Claude 3.5 Sonnet — zainhas · 2026-08-15
- Opus 模型被指删除文档时废话连篇 — JasonBotterill · 2026-08-15