V4.1 Flash 本地跑 200 t/s,OpenRouter 上竟低至 13 t/s
teortaxesTex · x · 2026-09-23
推主 teortaxesTex 指出所谓「Flash」命名的中国模型实际速度名不副实。他本地测 DeepSeek V4.1 Flash 稳定超过 200 tokens/s,但在 OpenRouter 上第三方实测首方 API 仅 67 t/s,且不同渠道速度从 13 到 150 t/s 不等,质疑普通用户的实际体验远逊于宣传。引用推还吐槽 DeepSeek 4.1 Flash 和 GLM 5.3 Flash 都慢得离谱,「Flash」命名在中国模型里似乎已失去快速含义。
「模型」频道最新
- Browser Use Bench v2 榜单刷新:GPT-6 Sol 66.9 分反超且便宜 3.5 倍 — airesearch12 · 2026-09-23
- 曝有人提前体验 Claude Opus 5.5,用来做游戏项目效果远超预期 — FinanceYF5 · 2026-09-23
- 5万美元悬赏无人认领:任何2022年前的法语文学都被判为AI — Afinetheorem · 2026-09-23
- Pangram 回应质疑:误报率在测试集上测量,长文本几乎零误报 — cephaloform · 2026-09-23
- 传 GPT-6 Sol 在 DeepSWE 等基准反而逊于 5.6 Sol:被讽只是改名 Terra — kristoph · 2026-09-23
- 网友实测绘图任务:Opus 5.5 效果更好但耗 10 倍 token — OfirPress · 2026-09-23