专题 · FULL STORY

蚂蚁Ling-3.0-tiny:从发布到开源登顶

蚂蚁百灵团队发布并开源了轻量级混合推理模型Ling-3.0-tiny。该模型仅激活1.3B参数,凭借出色的稀疏架构迅速登顶Hugging Face热门榜单。

2026-08-07 ~ 2026-08-12 · 2 集 · 9 条

第 1 集 · AntLingAGI 发布原生混合推理模型 Ling-3.0-tiny(2026-08-07,2 条)

AntLingAGI 正式发布 Ling-3.0-tiny 原生混合推理模型。该模型总参数量为 7.9B,但每个 token 仅激活 1.3B 参数。这种稀疏激活设计专为实际任务、数学计算、指令遵循以及资源受限的部署场景而打造,展现出小模型在端侧等市场的巨大应用潜力。

第 2 集 · 蚂蚁开源Ling-3.0-tiny:1.3B激活参数登顶HF热门榜(2026-08-11,7 条)

蚂蚁百灵大模型团队继Ling-3.0-flash之后,正式开源了全新的轻量级混合推理MoE模型Ling-3.0-tiny。该模型总参数量7.9B,但每token激活参数仅1.3B,主打极致的推理效率与真实的任务执行能力,目前已登上Hugging Face热门榜,为本地部署智能体应用提供了新的低算力门槛选项。

已确认

  • 架构与参数:采用混合专家(MoE)架构,包含128个专家,总参数量7.9B,激活参数1.3B。模型采用了3:1的KDA(Kimi增量注意力)与MLA架构,支持262K上下文。
  • 开源规格:提供BF16、FP8和INT4多种精度版本,包含customcode,基于MIT协议开源。
  • 性能表现:在Artificial Analysis评测中,其智能指数得分达到16.7。据测试,其整体性能介于4B到12B的Qwen模型之间,且以1.3B的激活参数跑赢了部分更大参数规模的模型(如31B或GPT-OSS 120B的部分指标)。
  • 适用场景:专为推理、工具调用和智能体任务设计,适合高效的本地部署。

为什么重要

Ling-3.0-tiny以极低的激活参数量实现了越级的性能表现,大幅降低了端侧或本地部署智能体应用时的算力门槛,为开发高效率的真实任务执行系统提供了极具竞争力的开源选项。