ComfyUI 中 Qwen3-VL 4B 关掉 thinking 会零 token
audax8177 · reddit · 2026-07-25
作者在 ComfyUI 里用 Qwen3-VL 4B 做图片理解并生成提示词时,观察到两套明显不同的行为:
- Heretic 版本:通常能正确描述图片,连一些官方模型会判定为敏感的图片也能出结果;但当 thinking: false 时,模型有时会直接输出 0 个 token,导致后续节点报错“文本为空”。
- 把 thinking: true 打开后,Heretic 版本又能稳定生成,且作者表示生成速度并没有明显变化。
- 官方 Qwen3-VL(bf16 / fp8scaled)则没有 zero-token 问题,但遇到被判定为 explicit 或 sensitive 的图片时,可能会因为安全策略拒答描述。
帖子最后在排查问题来源:是 ComfyUI / 自定义节点更新引入的变化,还是 chat template、EOS 处理,或者 thinking 参数传递方式出了问题。
「多模态」频道最新
- Moonshot AI 发布 Kimi K3:2.8 万亿参数和 100 万上下文 — dl_weekly · 2026-07-25
- Midjourney 提示词做出 Risograph 印刷感,保留颗粒与套印偏差 — tisch_eins · 2026-07-25
- 一组 Midjourney 风格探索:偏暗黑电影感人像 — Salmaaboukarr · 2026-07-25
- Genfocus 的 Flux1-dev 对焦工作流在 3090 上频繁崩溃 — ReasonablePossum_ · 2026-07-25
- Snap 测试消息内生成歌曲,跟进 AI 音乐赛道 — venturetwins · 2026-07-25
- AI 动画把熊猫坐火车做成糖果童话 — PromptVaultCo · 2026-07-25