Ling-3.0-flash混合架构MoE模型开源

inclusionAI与AntLingAGI团队在Hugging Face开源了新一代原生混合推理模型Ling-3.0-flash。该模型采用MIT协议,总参数量约124B至127B,基于混合线性MoE架构设计。其官方FP8版本极大降低了部署门槛,仅需128GB显存即可运行。

2026-08-04 ~ 2026-08-04 · 2 条相关

事件全程(共 4 集)→