DeepSeek 全系列模型实测:242 个单次生成结果对比
kms_dev · reddit · 2026-08-03
作者周末对 OpenRouter 上便宜的模型进行了单次提示测试,本次放出了 10 个 DeepSeek 模型在 35 个相同提示词下的表现。
由于提供商错误或返回为空,最终 350 个矩阵中只有 242 个成功输出。测试涵盖了 DeepSeek V4 (Pro/Flash)、V3.x (V3.2/V3.1-terminus 等) 以及 DeepSeek R1 系列模型,并提供了在线对比页面。
「模型」频道最新
- OpenAI与Anthropic延迟发布,是为防开源追赶? — 0xsachi · 2026-08-04
- RL 强化思考远胜直觉:模型扩展正从算力转向推理 — intellectronica · 2026-08-04
- OpenAI模型贡献234项数学成果,远超DeepMind — haider1 · 2026-08-04
- OpenAI 未发布模型解破 10 大数学难题,推理成本仅 2000 美元 — Mobile_Distance_9598 · 2026-08-03
- 基准测试的猫腻:通过控制评测项目可得出任何预设结论 — felix_red_panda · 2026-08-03
- Teknium:DeepSeek V4 Flash本地推理可达70 tokens/s — Teknium · 2026-08-03