跑分相近体积差一倍多:Qwen3.8-Flash-Next 疑靠规模追平 DeepSeek
vini542reddit · reddit · 2026-08-28
作者实测发现,榜单成绩相近的 Qwen3.8-Flash-Next(Q38FN) 与 DeepSeek-V4-Flash(DSv4F) 在真实使用中差距很大:
- DSv4F 用 Unsloth Q8KXL 可无损跑在 162GB;在 4×RTX 3090 + 192GB DDR4 @3200MHz 上约 30 tps、230 pp。
- Q38FN 要无损运行需要约 360GB,是前者的两倍多;Unsloth 尚未提供无损 Q8,其列出的 Q8(270GB)也并非无损。
- 作者推测 Q38FN 仍处架构早期,后续会有优化,但目前看阿里像是靠把模型做大来换跑分;若量化到与 DSv4F 相当的 Q4/Q5 体积,性能会明显掉。
结论:当前 benchmark 有误导性,同跑分下模型体积/量化成本差异巨大。
「模型」频道最新
- 用户反馈:o3 Pro 停服,Deep Research 仍具强大威力 — bytebot · 2026-08-28
- 腾讯混元 Hy4 预览版冲进 WebDev Arena 第5,开源阵营第3 — TencentHunyuan · 2026-08-28
- 终端评测 TB-fn 揭露:多模型高分系刷榜 — burny_tech · 2026-08-28
- 曝OpenAI为Codex开发Persistent Mode:常驻自派任务,曾误删用户数据 — The Decoder · 2026-08-28
- GLM 5.3 Flash 跃居 OpenRouter 日用量第四 — Hesamation · 2026-08-28
- 腾讯开放 Hy4 预览权重:770B MoE、49B 激活、1M 上下文 — Snoo26837 · 2026-08-28