实测反馈:Qwen3.8 思考链过长且往往答非所问
WhatererBlah555 · reddit · 2026-08-15
用户实测 Qwen3.8 27B 模型后表示不满意,主要问题是模型在开始实际任务前会进行大量“思考”,且经常超出任务范围,导致浪费时间和上下文。相比之下,之前的 Q3.6 虽有类似倾向但尚可控,用户询问社区是否有类似的实际使用体验。
所属事件:用户实测 Qwen3.8 思考链过长答非所问(2 条相关)→
「模型」频道最新
- llama.cpp 集成 Moonshot Kimi-K3 文本模型 — pmttyji · 2026-08-15
- GLM 5.3 技术报告揭示使用合成 RL 环境训练 — burny_tech · 2026-08-15
- Qwen2.5 vs Qwen2 vs Gemma 4:30B级开源模型实测 — MaySaki2 · 2026-08-15
- 测试 Fable 5 模型用于蒸馏的重定向行为 — teortaxesTex · 2026-08-15
- Gemini 3.7 Flash:可实时生成完整交互式网站 — _philschmid · 2026-08-15
- Qwen 3.8 27B 在某 Harness 下几乎不思考的测试 — rosie254 · 2026-08-15