专题 · FULL STORY
蚂蚁Ling-3.0-tiny:从发布到开源登顶
蚂蚁百灵团队发布并开源了轻量级混合推理模型Ling-3.0-tiny。该模型仅激活1.3B参数,凭借出色的稀疏架构迅速登顶Hugging Face热门榜单。
2026-08-07 ~ 2026-08-12 · 2 集 · 9 条
第 1 集 · AntLingAGI 发布原生混合推理模型 Ling-3.0-tiny(2026-08-07,2 条)
AntLingAGI 正式发布 Ling-3.0-tiny 原生混合推理模型。该模型总参数量为 7.9B,但每个 token 仅激活 1.3B 参数。这种稀疏激活设计专为实际任务、数学计算、指令遵循以及资源受限的部署场景而打造,展现出小模型在端侧等市场的巨大应用潜力。
- Ling-3.0-tiny发布:7.9B总参数仅1.3B激活,小模型市场潜力大 — natolambert · 2026-08-07
- 蚂蚁 Ling 3.0 Tiny 发布:仅激活 1.3B 参数主打 Agent — truecakesnake · 2026-08-07
第 2 集 · 蚂蚁开源Ling-3.0-tiny:1.3B激活参数登顶HF热门榜(2026-08-11,7 条)
蚂蚁百灵大模型团队继Ling-3.0-flash之后,正式开源了全新的轻量级混合推理MoE模型Ling-3.0-tiny。该模型总参数量7.9B,但每token激活参数仅1.3B,主打极致的推理效率与真实的任务执行能力,目前已登上Hugging Face热门榜,为本地部署智能体应用提供了新的低算力门槛选项。
已确认
- 架构与参数:采用混合专家(MoE)架构,包含128个专家,总参数量7.9B,激活参数1.3B。模型采用了3:1的KDA(Kimi增量注意力)与MLA架构,支持262K上下文。
- 开源规格:提供BF16、FP8和INT4多种精度版本,包含customcode,基于MIT协议开源。
- 性能表现:在Artificial Analysis评测中,其智能指数得分达到16.7。据测试,其整体性能介于4B到12B的Qwen模型之间,且以1.3B的激活参数跑赢了部分更大参数规模的模型(如31B或GPT-OSS 120B的部分指标)。
- 适用场景:专为推理、工具调用和智能体任务设计,适合高效的本地部署。
为什么重要
Ling-3.0-tiny以极低的激活参数量实现了越级的性能表现,大幅降低了端侧或本地部署智能体应用时的算力门槛,为开发高效率的真实任务执行系统提供了极具竞争力的开源选项。
- 蚂蚁Ling团队开源8B参数MoE大模型Ling-3.0-tiny — tomaarsen · 2026-08-11
- inclusionAI发布Ling-3.0-tiny:8B参数超小型MoE架构 — -Cubie- · 2026-08-11
- Ling-3.0-tiny 发布:1.3B 活跃参数跑赢 GPT-OSS 120B — solyarisoftware · 2026-08-11
- AntLingAGI 发布 Ling-3.0-tiny 开源模型,主打智能体任务 — AccBalanced · 2026-08-11
- 蚂蚁 inclusionAI 发布 Ling-3.0-tiny 模型 — inclusionAI · 2026-08-11
- 蚂蚁开源轻量级 MoE 模型,1.3B 激活跑赢 31B — 智东西 · 2026-08-11
- 蚂蚁发布Ling 3.0 Tiny:79亿参数跑出高智商,但极耗Token — ArtificialAnlys · 2026-08-12