Qwen 3.8 低推理模式实测:循环次数显著减少
Lair98 · reddit · 2026-08-22
用户反馈 Qwen 3.8 在推理设置为“low”时,循环次数比 3.6 版本明显减少,即使在 3-bit 量化下表现也更好。
关键发现:
- 模型默认设置为 xhigh,需手动改为 low 才能减少循环。
- 新增参数 preservethinking,允许在每轮对话后保留/丢弃推理过程。激活该参数可避免模型重复推理相同内容。
- 实测表明 3.8 版本在“低”模式下的循环行为虽有改进但仍非完美。
「模型」频道最新
- 调优 LLM 写新闻数月后:事实好办,文风单调难治 — ivan_bezdomny · 2026-08-22
- 2026 年端侧小模型选型:Gemma 4 与 Qwen3.5 — lmoroney · 2026-08-22
- Ox Alpha 模型实测:在 Pi Harness 中表现惊艳 — omarsar0 · 2026-08-22
- LLM 生成诡异文本,疑是合成数据中的自我对话 — ctjlewis · 2026-08-22
- Ornith 1.5 35B上线RunInfra:缓存后输入约每百万$0.02 — alejandroll10 · 2026-08-22
- 开发者质疑 Ox-alpha 模型表现,或为营销噱头 — bindureddy · 2026-08-22