实测发现:Qwen3.5关闭思考模式后仍会自发进行深度推理
_lewtun · x · 2026-07-30
Hugging Face 工程师 Lewis Tunnicliffe 发现,在评估 Qwen3.5 模型时,即使将 enablethinking 设置为 false,模型依然会通过输出 "Wait, ..." 甚至 <think> 标签来进行某种形式的扩展推理。特别是在非主要领域(如生物学)的测试中,这种现象尤为明显,并会产生大量 token。相比之下,Gemma4 模型在关闭该模式后则表现得很规矩。这引发了关于不同模型后训练策略差异的讨论。
「模型」频道最新
- P-Image-Ideogram 登顶图像生成性价比前沿 — _akhaliq · 2026-07-30
- 别只看API报价:公众号揭示大模型“缓存比例”与量化潜规则 — 赛博禅心 · 2026-07-30
- 连 Gemini 都比初中生聪明?模型能力梗图 — DangerousSpray3656 · 2026-07-30
- MoTA架构:用4MB的LoRA适配器替代海量Context,推理存储成本降百倍 — EyalToledano · 2026-07-30
- LightOn 团队发布开源多语言检索模型 mDenseOn 与 mLateOn — antoine_chaffin · 2026-07-30
- Kimi K3 表现优异但价格偏高,谁打价格战谁拿百亿估值 — bindureddy · 2026-07-30