DeepSeek v4-pro 评测:极低成本比肩 Opus,日常体验差异微乎其微
haider1 · x · 2026-08-13
作者指出,DeepSeek v4-pro 在多项基准测试中以极低成本击败了 Opus 4.8,表现确实惊人。但他同时认为,目前前沿模型之间的分数差距往往只有几分,在实际日常应用中(除了一次性 Demo 外),用户很难感知到明显的体验差异。
「模型」频道最新
- DeepSeek 网安实测:召回率登顶但精度垫底 — teortaxesTex · 2026-08-13
- 用 Grok 4.6 搭建《办公室》智能体模拟,实测速度与能力大升级 — mattyp · 2026-08-13
- Sakana AI 更新 Chat:新增 Fugu 模型并支持代码执行 — SakanaAILabs · 2026-08-13
- 开发者实测 Gemini V4-Pro:表现不及预期,疑似受蒸馏影响 — teortaxesTex · 2026-08-13
- DeepSeek V4-Pro 评测升至开源第二,被指仅靠 pass@2 刷分 — teortaxesTex · 2026-08-13
- GPT模型画像素画翻车:交互失败与生成惨案 — breath_mirror · 2026-08-13