V4.1 Flash 本地跑 200 t/s,OpenRouter 上竟低至 13 t/s

teortaxesTex · x · 2026-09-23

推主 teortaxesTex 指出所谓「Flash」命名的中国模型实际速度名不副实。他本地测 DeepSeek V4.1 Flash 稳定超过 200 tokens/s,但在 OpenRouter 上第三方实测首方 API 仅 67 t/s,且不同渠道速度从 13 到 150 t/s 不等,质疑普通用户的实际体验远逊于宣传。引用推还吐槽 DeepSeek 4.1 Flash 和 GLM 5.3 Flash 都慢得离谱,「Flash」命名在中国模型里似乎已失去快速含义。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →