Qwen 3.8 Next Flash 太啰嗦:单轮编码请求思考长达13分钟

Infinite-Local5435 · reddit · 2026-09-07

一位长期使用 Qwen 3.6 27B 的 Reddit 用户反馈,切换到 Qwen 3.8 Next Flash 后推理极其冗长:在约 150 tokens/秒的生成速度下,单轮编码请求思考时间可达 13 分钟(约 7000 思考 token)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →