DeepSeek V4 Flash 编码榜单反超 Qwen 3.8 Max 和 GLM 5.2
airesearch12 · x · 2026-08-04
作者称 DeepSeek V4 Flash 在 Artificial Analysis Coding Index 上表现非常强。
配图显示,它的分数超过了新发布的 Qwen 3.8 Max,而后者被标注为体量超过它的 8 倍;同时也超过了体量约为它 2.5 倍的 GLM 5.2。重点是“更小模型跑赢更大模型”的编码基准对比。
「模型」频道最新
- 州总检察长要求 OpenAI 保全记录,涉 AI agent 黑客调查 — GaryMarcus · 2026-08-04
- Anthropic 遭遇新一轮反弹,用户称 Opus 5 越用越差 — kimmonismus · 2026-08-04
- Qwen3.8-Max 被指在无人机和卫星影像上很强 — teortaxesTex · 2026-08-04
- 一个 AI 拳击 benchmark 记录速度、延迟和闪避准确率 — jerkosaur · 2026-08-04
- 关于物理规则 AI 拳击 benchmark 的重复帖子 — jerkosaur · 2026-08-04
- G9v3-39A5B 模型发布:主打低幻觉的 Agentic 重度 MoE — axseem · 2026-08-04