实测 Qwen 3.8 27B 编码能力碾压 3.6 35B
N34257 · reddit · 2026-08-22
用户对比发现,Qwen 3.8 27B 在编码任务(特别是代理编码)上表现显著优于旧版 3.6 35B。在自动生成塔防游戏代码的测试中,35B 模型报错不断,而 27B 模型不仅无错完成,还主动进行了全流程自测验证,被评价为“超模(OP)”。
所属事件:实测 Qwen3.8 27B 编码能力反超更大旧版(2 条相关)→
「模型」频道最新
- 网友猜测某预览模型可能来自中国实验室的轻量级 Flash 模型 — brandon_galang · 2026-08-23
- Ox 模型评测:单次生成能力强但长语境任务需引导 — rachittshah · 2026-08-23
- Grok 4.6 凭借更少步骤与Token,实现更快更便宜的任务执行 — XFreeze · 2026-08-23
- ProgramBench 评测结果:Opus 5 依然领先,0813 为最强开源模型 — teortaxesTex · 2026-08-23
- Qwen3.8-27B 发布一周:社区全方位评测汇总 — Jonathan_Rivera · 2026-08-23
- 用户推测 Opus 5 变啰嗦或为配合水印检测 — cool_architect · 2026-08-23