DeepSeek Flash 实测落后 Grok 4.5 和 Muse Spark
bindureddy · x · 2026-08-04
X 上有人把 DeepSeek Flash 吹成了“Fable 级”模型,但这条帖直接反驳:它不是前沿模型,实测表现明显弱于 Grok 4.5 和 Muse Spark。
- 配图里的榜单显示,DeepSeek V4 Flash 0731 的整体分数低于几款顶级模型。
- 作者认为它更像是一个很强的小模型,擅长刷榜,但不该被归类为 frontier model。
- 核心结论是:热度很高,不代表能力已经进入第一梯队。
「模型」频道最新
- X 帖调侃 Anthropic 年底营收可冲 1000 亿美元 — Jsevillamol · 2026-08-04
- 传 DeepSeek 正转向下一代架构,不做 V4-Ultra — teortaxesTex · 2026-08-04
- 重置 Windows 后,RTX 3070 的本地 Qwen3.6-35B 吞吐恢复了 — campaigner_ · 2026-08-04
- ChatGPT 的反谄媚训练正催生“表演性中立” — Chance-Physics-7216 · 2026-08-04
- Qwen 3.8 Max 分析类成绩亮眼,被赞可替代 Opus 4.7 — Ill_Distribution8517 · 2026-08-04
- 一条帖子列出三档 GPT 5.6 版本和参数量梗 — AndyMasley · 2026-08-04