DeepSeek-V3 超越 GPT-4o 与 Claude 3.5 Sonnet
zainhas · x · 2026-08-15
据评测,DeepSeek-V3 (Pro 0813) 在 DeepSWE 基准测试的 pass@4 指标上表现优异,超越了 GPT-4o 和 Claude 3.5 Sonnet (文中写作 Fable 5)。用户称该模型时有惊艳表现。
「模型」频道最新
- DeepSeek-V4 Pro 与 Fable 任务相关性最低 — zainhas · 2026-08-15
- DeepSeek-V4 Pro 击败 Sol 与 Fable — zainhas · 2026-08-15
- 27B 参数 Qwen 3.8 全指标碾压传闻中万亿模型 — zainhas · 2026-08-15
- 90%用户不需要SOTA模型,谷歌瞄准大众市场 — haider1 · 2026-08-15
- Veo、H3、Seedance视频生成对比 — Then_Editor_7958 · 2026-08-15
- Opus 模型被指删除文档时废话连篇 — JasonBotterill · 2026-08-15