DeepSeek V4 Flash 综合分击败 Qwen3.8-27B
solyarisoftware · x · 2026-08-19
SparkBench 评测数据显示,DeepSeek V4 Flash 以 93.01 分击败 Qwen3.8-27B 的 90.94 分。在细分领域,DeepSeek 在代码、Agent 和工具使用上胜出,而 Qwen 则在鲁棒性和校准度上保持领先。DeepSeek V4 Flash 的中位数延迟更低且输出更简洁。
「模型」频道最新
- GLM-5.3 评测指数达 60 分,仍是中国最强模型之一 — teortaxesTex · 2026-08-19
- Codex 新版破坏 subagents,回退 0.142.0 可规避 — chibop1 · 2026-08-19
- 让模型厂商自测基准,如同学生自己监考SAT — MattPerault · 2026-08-19
- Grok 4.6 金融尽调基准并列第二,单任务成本仅 0.84 美元 — karinanguyen · 2026-08-19
- Perplexity 上线美国托管 DeepSeek V4 Pro,WANDR 评测性价比出众 — perplexity_ai · 2026-08-19
- 智谱 GLM-5.3 上线,编码性能提升 50% — gaganghotra_ · 2026-08-19