Qwen 预热新模型,从业者力挺稀疏 MoE:小专家更利推理

lxfater · x · 2026-10-10

Qwen 开发者账号发布「big or small?」的预热内容,暗示即将公布大小取向的新模型。开发者 lxfater 转发并表态:会选择稀疏模型,因为小专家结构对推理更友好——稀疏 MoE 在推理时只激活部分参数,能降低推理成本。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →