Qwen 3.8 27B 复杂编程翻车,实测不如 DeepSeek 与 GLM
myreala · reddit · 2026-08-19
用户分享了 Qwen 3.8 27B 在复杂 C 语言内核编程任务中的实测表现。任务是将 DeepSeek Pro 已写好的 TTS 执行内核中某元素的线程数限制进行调整。作者在单张 3090 上进行了约 6 小时的尝试(开启 150k 上下文与 fp8 kv cache),Qwen 最终陷入循环,生成的代码质量极差且伴有工具调用失败,未能完成任务。相比之下,GLM 5.3 仅用约 20 分钟便成功搞定。作者表示对 Qwen 失望,不愿投入更多成本尝试更高配置。
「模型」频道最新
- 用户吐槽 Claude 掉智商,Anthropic 紧急挽回 — annetgriffin · 2026-08-19
- 称 Flash 3.7 超越 GPT-Terra 与 Claude,表现欠宣传 — bindureddy · 2026-08-19
- 用户实测:Gemini 3.7 Flash 被评为内部Slack机器人最佳模型 — amankhan · 2026-08-19
- GLM 5.3 评测跻身第一梯队,表现亮眼 — markjeffrey · 2026-08-19
- 让 Qwen3.8 自己读 README,它猜出了自己为何这么强 — MikePFrank · 2026-08-19
- 图表显示 Qwen3.8 同尺寸性能异常突出 — MikePFrank · 2026-08-19