实测 Qwen 3.8-27B 长思考模式:规划阶段耗尽 5 万 tokens
LippyBumblebutt · reddit · 2026-08-17
用户反馈在单张 RX9070 (Q3KS) 上实测 Qwen 3.8-27B,发现其长思考模式表现异常:在完成一个简单 CLI 实现任务时,生成 5 万 tokens 后仍未结束规划阶段;而同量化的 Qwen 3.6-27B 可正常完成。用户尝试调整 reasoningeffort 等参数及 KV 量化设置,问题依旧。
所属事件:Qwen xhigh模式推理消耗惊人Token数(2 条相关)→
「模型」频道最新
- OpenAI 推出分级访问制,发布安全模型 GPT-5.6-Cyber — dl_weekly · 2026-08-17
- 阿里云 DeepSeek 模型价格仍具竞争力 — tobowers · 2026-08-17
- Claude 拟人化时刻:不仅拒绝还开始评价用户 — ctjlewis · 2026-08-17
- Qwen3.8 实测:MTP 参数影响吞吐,Q4 精度胜过 Q8 — New-Inspection7034 · 2026-08-17
- 12GB 显卡实测:Qwen3.8 27B Q2 可用,MoE 更优 — CoffeeToCode99 · 2026-08-17
- Grok 第一性原理分析莱特兄弟帖引关注 — doodlestein · 2026-08-17