inclusionAI发布Ling-3.0-tiny:8B参数超小型MoE架构
-Cubie- · reddit · 2026-08-11
inclusionAI 在 Hugging Face 上开源了 Ling-3.0-flash 的更小版本 Ling-3.0-tiny。该模型总参数量为 8B,激活参数仅为 1.3B。
据测试,其性能介于 4B 到 12B 的 Qwen 和 Gemma 模型之间。得益于极小的激活参数量,该模型在大多数系统上预计将拥有极高的 tokens/s 推理速度,展现了微型 MoE 架构在端侧部署的潜力。
所属事件:蚂蚁Ling团队开源8B参数MoE模型Ling-3.0-tiny(2 条相关)→
「模型」频道最新
- Muse Glimmer 30B 本地实测:精准定位医疗表单复选框 — MaziyarPanahi · 2026-08-11
- OpenAI 推出 GPT-5.6-Cyber 模型,专攻网络安全防御 — The Decoder · 2026-08-11
- Muse Glimmer 陷入终端指令死循环,消耗大量 Token — KingGongzilla · 2026-08-11
- Muse Spark 1.2 模型权重即将开源发布 — shuyanzh36 · 2026-08-11
- Claude 将黎曼猜想满足比例下界提升至 67.2% — BoyNextDoor1990 · 2026-08-11
- 曝 Google Gemini Omni Lite 即将发布,主打视频生成与编辑 — koltregaskes · 2026-08-11