Qwen 3.8 或今日发布:27B 密集模型,MoE 本地部署优势不再

zyxciss · reddit · 2026-08-14

Reddit 用户讨论 Qwen 3.8 可能于今日发布,预计为 27B 密集模型。若属实,将不再支持 MoE 稀疏架构,本地部署时推理速度可能大幅下降。此前 Qwen 3.6 35B-A3B 在 RTX 3060 上可达约 70 tok/s,而密集模型卸载可能慢 100 倍以上。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →