实测 Qwen 3.8 27B:默认推理级别过高导致严重过度思考
Simon Willison · rss · 2026-08-17
Simon Willison 实测了阿里巴巴开源的 27B 参数视觉模型 Qwen 3.8,发现其默认设置存在严重过度思考问题。
核心发现:
- 配置陷阱:模型默认将推理力度设为 xhigh,导致简单任务也消耗大量上下文和时间。
- 案例对比:
- 生成“骑自行机的鹈鹕” SVG:默认模式下耗时 21 分钟,生成 2.2 万个推理 Token;关闭推理后仅需 2 分多钟。
- 画圆任务:模型因“过度思考”生成了复杂动画而非简单圆圈。
- 视觉能力:在边界框标注测试中表现优异,能准确识别图像中的物体位置。
- Agent 潜力:在构建图像标注工具时,高推理模式虽然啰嗦,但能一次性生成可用的完整 HTML/JS 工具代码,低推理模式则需多次调试。
建议:用户应将推理级别设为 low 或关闭,除非处理极复杂任务。
「编程与Agent」频道最新
- WhatsApp 封禁新设备链接?开发者尝试四种库均失败 — Jason-Ping · 2026-08-17
- Qwen3.8 27B 在 RTX 4080 Super 上跑出 39 tok/s,本地编码够用 — BopSupreme · 2026-08-17
- ComfyUI 实现 MiniMax H3 混合模式:一条时间线多种生成方式 — Acceptable-Chest9695 · 2026-08-17
- MiniMax H3 混合模式详解:每个片段独立选择生成方式 — Acceptable-Chest9695 · 2026-08-17
- ChatGPT 旧对话优于新对话,用户吐槽质量随轮次下降 — DawniJones · 2026-08-17
- 红帽:构建生产级AI Agent的可观测性层 — blaizedsouza · 2026-08-17