Qwen 3.8 Next Flash 太啰嗦:单轮编码请求思考长达13分钟
Infinite-Local5435 · reddit · 2026-09-07
一位长期使用 Qwen 3.6 27B 的 Reddit 用户反馈,切换到 Qwen 3.8 Next Flash 后推理极其冗长:在约 150 tokens/秒的生成速度下,单轮编码请求思考时间可达 13 分钟(约 7000 思考 token)。
- 多数情况下输出质量尚可,但任务一旦需要决策,输出就变成 SWE 领域没人实际使用的黑话堆砌
- 自带 API Key 接入 VSCode 运行时间更短,但在 pi.dev 上一次请求经常要 1 小时
- 作者不愿调低 thinking 等级,因为尚无不同思考等级下模型表现的可靠 benchmark,而 3.8 27B 的经验显示调低会明显影响输出质量
「模型」频道最新
- SimpleBench 成绩显示 AI 常识推理超过人类 — DigSignificant1419 · 2026-09-07
- 腾讯 Hy4 成 OpenRouter 用量最高模型,却几乎无人讨论 — cantor8 · 2026-09-07
- Anthropic 称 Claude 写出史上最长数学证明,攻克 358 年悬案 — basedjensen · 2026-09-07
- Similarweb 流量榜:ChatGPT 份额一年从 73.3% 降至 55.5% — gaganghotra_ · 2026-09-07
- GPT-6 Astra 疑似上架 Simple-Bench,或含 Pro 版本 — From_Internets · 2026-09-07
- 实测 Gemini 当音乐理解模型:Pro 3.1 靠谱,Flash 幻听严重 — teropa · 2026-09-07