DeepSeek V4 Flash 在 DeepSWE 编程榜单与 Sonnet 5 并列
sdexca · reddit · 2026-08-01
据 DeepSeek 官方推文及 DeepSWE 数据面板显示,DeepSeek V4 Flash 的测试成绩与 Sonnet 5 和 Grok 4.5 处于同一梯队。不过发帖人强调,该成绩目前仅由 DeepSeek 单方面宣称,尚未得到 DeepSWE 官方的独立验证。
所属事件:DeepSeek 发布 V4-Flash 模型并预告 V4-Pro(81 条相关)→
「模型」频道最新
- MiniMax发布开源多模态模型H3,打通图音视频生成 — PrajwalTomar_ · 2026-08-01
- 图表对比揭示:DeepSeek性能全面超越Llama — teortaxesTex · 2026-08-01
- DeepSeek V4 Flash 性价比碾压:成本仅为 GPT-5.6 Luna 的 43% — zainhas · 2026-08-01
- DeepSeek V4 Flash 低价引发争论:OpenAI 利润率被指过高 — teortaxesTex · 2026-08-01
- 英伟达提出 Spatial-IQ 基准,揭示多模态模型空间推理缺陷 — NVIDIAAI · 2026-08-01
- Google DeepMind发布Gemini Robotics 2,赋能各形态机器人 — The Decoder · 2026-08-01