Qwen 预热新模型,从业者力挺稀疏 MoE:小专家更利推理
lxfater · x · 2026-10-10
Qwen 开发者账号发布「big or small?」的预热内容,暗示即将公布大小取向的新模型。开发者 lxfater 转发并表态:会选择稀疏模型,因为小专家结构对推理更友好——稀疏 MoE 在推理时只激活部分参数,能降低推理成本。
「模型」频道最新
- 同速下便宜 33%:Opus 5.5 Fast 定价压过 Sol 6.1 Ultrafast — kimmonismus · 2026-10-10
- 开发者吐槽 Grok 文风烦人:满嘴低幼类比和 AI 味套话 — max_paperclips · 2026-10-10
- OpenAI 定价页惊现未发布模型 gpt-rosalind-discovery,定价 $5/$25 — testingcatalog · 2026-10-10
- 爆料称 Kimi K3.1 十月中上旬上线,主攻长程 Agent 能力 — teortaxesTex · 2026-10-10
- Kimi K3.1 发布时间存疑:ChrisGPT 否认 10 月中旬前上线传闻 — ChrisGPT · 2026-10-10
- Codex 被指降智严重,vista8 实测 GPT-61 Sol High 档位相对靠谱 — vista8 · 2026-10-10