Qwen 3.8 27b 代码强逻辑弱,本地模型仍需取舍
Afinetheorem · x · 2026-08-17
评测者指出,Qwen 3.8 27b 是目前在家用高性能 GPU 上能运行的最佳本地 LLM 之一,但这背后牺牲了很多。虽然它在代码基准测试中表现优异,但在逻辑和视觉推理基准测试中却是测试过的最差模型之一,远不如 SOTA 模型(46/58/68)。
所属事件:Qwen 3.8 27B 深度推理引争议,社区实测辩护(5 条相关)→
「模型」频道最新
- Grok 4.6 编码实测:搞定复杂逻辑但系统性遗漏基础 — mark_k · 2026-08-18
- Qwen3.8-27B 基准测试与 DeepSeek V4、GPT-5.6 Luna Max 并驾齐驱 — anderspitman · 2026-08-18
- Orion 16B 突破 1000 亿训练 Token,利用 DPP 分布式算力 — markjeffrey · 2026-08-18
- RareBench 实测:Gemini 3.7 Flash 大跃升,DeepSeek Pro 未见提升 — danielmckinn0n · 2026-08-18
- DeepSeek V4-Pro 正式全量上线:可调推理强度并新增 Responses API — thione · 2026-08-18
- xAI 发布 Grok 4.6:主打长时 Agent 任务,基准追平 GPT-5.6 Sol — thione · 2026-08-18