实测 Qwen 35B-A3B MoE:本地编码速度比 27B 稠密版快 4 倍

WSTangoDelta · reddit · 2026-08-08

开发者对比了 Qwen 35B-A3B MoE 与 27B 稠密模型在本地编码任务上的表现。在特定硬件和 llama.cpp 环境下,MoE 模型生成速度约快 3.9 倍(116 tok/s vs 30 tok/s)。

在常规 Bug 修复和多文件修改中,两者表现相当。随着测试难度提升,稠密模型在处理隐含逻辑和边缘情况时展现出优势,但整体质量差距远小于速度差异。这表明在实际开发中,不应将激活参数量作为衡量模型实用能力的唯一标准。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →