inclusionAI发布Ling-3.0-tiny:8B参数超小型MoE架构

-Cubie- · reddit · 2026-08-11

inclusionAI 在 Hugging Face 上开源了 Ling-3.0-flash 的更小版本 Ling-3.0-tiny。该模型总参数量为 8B,激活参数仅为 1.3B。

据测试,其性能介于 4B 到 12B 的 Qwen 和 Gemma 模型之间。得益于极小的激活参数量,该模型在大多数系统上预计将拥有极高的 tokens/s 推理速度,展现了微型 MoE 架构在端侧部署的潜力。

所属事件:蚂蚁Ling团队开源8B参数MoE模型Ling-3.0-tiny(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →