实测 Qwen 35B-A3B MoE:本地编码速度比 27B 稠密版快 4 倍
WSTangoDelta · reddit · 2026-08-08
开发者对比了 Qwen 35B-A3B MoE 与 27B 稠密模型在本地编码任务上的表现。在特定硬件和 llama.cpp 环境下,MoE 模型生成速度约快 3.9 倍(116 tok/s vs 30 tok/s)。
在常规 Bug 修复和多文件修改中,两者表现相当。随着测试难度提升,稠密模型在处理隐含逻辑和边缘情况时展现出优势,但整体质量差距远小于速度差异。这表明在实际开发中,不应将激活参数量作为衡量模型实用能力的唯一标准。
「编程与Agent」频道最新
- pi 推出会话间协作插件:支持多智能体互发消息与递归拆解 — solyarisoftware · 2026-08-08
- 开发者称已将AI智能体沙盒化,配图却显示其越权操作 — dejavucoder · 2026-08-08
- 构建防幻觉评估体系:如何有效监测大模型生成质量 — goyalshaliniuk · 2026-08-08
- Cloudflare开源Computer:为AI智能体提供持久化虚拟文件系统 — bibryam · 2026-08-08
- 开源 .NET 智能体记忆引擎:基于 Neo4j 实现持久化 — adnan_hashmi · 2026-08-08
- 开发者实测:Codex Mac 版编程体验已超越 Claude — AarushSelvan · 2026-08-08