Qwen 3.8 27B 本地实测:默认过度思考极耗资源
marlene_zw · x · 2026-08-17
Simon Willison 发布了对阿里 Qwen 3.8 27B 模型的深度评测。该模型采用 Apache 2.0 协议,具备视觉能力,官方基准测试显示性能强劲,甚至在某些方面超越此前的闭源版本 Qwen 3.7-Plus。Willison 在 MacBook Pro 和 NVIDIA DGX Spark 上运行了量化版本,发现模型默认将推理深度设为最高级,导致其在处理简单任务时产生冗长的“过度思考”,极快消耗上下文窗口,虽然娱乐效果拉满,但实际使用成本高昂,建议用户调整参数。
「模型」频道最新
- 用户炮轰 Claude:生物类提问疑似被路由到更弱模型 — jonkhler · 2026-08-17
- Claude 疑似又宕机,用户调侃:正好赶上我去睡觉 — IgorBrigadir · 2026-08-17
- 月发十余款 SOTA 模型,企业工具链难跟上 — mattturck · 2026-08-17
- Karpathy:LLM 意在模仿而非成功,超半数项目错用 Agent — leslysandra · 2026-08-17
- Claude疑似有新动作,网友期待新功能 — ctjlewis · 2026-08-17
- Simon Willison 评测 Qwen 3.8 27B:优秀但默认过度思考 — NelsonMinar · 2026-08-17