蚂蚁开源Ling-3.0-flash:124B参数仅激活5.1B
蚂蚁集团旗下inclusionAI于8月4日在Hugging Face开源了Ling-3.0-flash模型。该模型总参数量约124B,但每个token仅激活5.1B参数,采用MoE架构,支持256K上下文,并采用纯正MIT协议。官方称其性能可媲美激活参数达1T的旗舰模型,FP8量化版仅需128GB显存即可部署,已上线AI/ML API平台并提供免费使用期。这一极低激活率与高性价比的组合引发社区广泛关注。
已确认
- 架构与参数:总参数量在124B至127.5B之间(不同帖子统计口径略有差异),激活参数为5.1B(约占总参的1/64)。采用512个路由专家加1个共享专家的MoE架构,并从预训练阶段即原生引入混合线性架构,支持256K上下文。
- 部署成本:官方提供BF16和FP8量化版本,其中FP8版本部署仅需128GB显存,大幅降低了超大模型的硬件门槛。
- 功能与评测表现:模型支持思考模式与工具调用,并提供了完整的对话模板配置。官方报告显示其在SWE-bench等基准测试中表现优异,官方称其性能可媲美激活参数达1T(万亿参数级别)的旗舰模型。
- 开源与API可用性:模型采用了无商业限制的纯正MIT协议。此外,该模型已上线AI/ML API平台,并提供免费使用期。
为什么重要
- Ling-3.0-flash通过极低的参数激活率兼顾了模型容量与推理成本,在保证高性能的同时显著降低了部署门槛,为开源社区提供了一个极具性价比的大规模混合推理模型选择。
2026-08-04 ~ 2026-08-06 · 11 条相关
- 第 1 集:蚂蚁推出124B参数MoE模型Ling-3.0-flash(2026-07-24,12 条)
- 第 2 集:蚂蚁集团发布 Ling-3.0-flash 混合推理模型(2026-07-27,2 条)
- 第 3 集:蚂蚁百灵发布 Ling-3.0-flash 混合推理模型(2026-07-29,2 条)
- 第 4 集:蚂蚁开源Ling-3.0-flash:124B参数仅激活5.1B(2026-08-04,11 条)
一手来源
- Ling-3.0-flash 开源:127B 参数 MoE 架构,官方 FP8 仅需 128GB — derspenti ·
- 蚂蚁集团开源 124B 模型,采用纯正 MIT 协议无商业限制 — Asleep-Pilot-4142 ·
- 蚂蚁 Ling-3.0-flash 开源:总参 124B 激活仅 5.1B,SWE-bench 得分亮眼 — Asleep-Pilot-4142 ·
- Ling-3.0-flash 开源:124B 混合线性架构 MoE 发布 — NielsRogge · 2026-08-04
- 【源头】Ling-3.0-flash 开源:127B 参数 MoE 架构,官方 FP8 仅需 128GB — derspenti · 2026-08-04
- Ling-3.0-flash 模型开放权重,提供 BF16 与 FP8 版本 — aftahi_ai · 2026-08-05
- 仅激活 5.1B 参数,蚂蚁 Ling-3.0-flash 架构与成本深度解析 — jkris050 · 2026-08-05
- 【源头】蚂蚁 Ling-3.0-flash 开源:总参 124B 激活仅 5.1B,SWE-bench 得分亮眼 — Asleep-Pilot-4142 · 2026-08-05
- Ling 3.0 Flash 发布:5.1B 活跃参数媲美万亿旗舰 — AdinaYakup · 2026-08-05
- inclusionAI 发布 Ling 3.0 flash 混合线性推理模型 — AdinaYakup · 2026-08-05
- Ant Ling 3.0 Flash 开源:124B 参数媲美 1T 旗舰 — FellMentKE · 2026-08-05
- inclusionAI 开源 Ling-3.0-flash 模型权重 — FellMentKE · 2026-08-05
- 蚂蚁 Ling-3.0-flash 上线 API,124B 参数主打低成本智能体 — rohanpaul_ai · 2026-08-06
- 【源头】蚂蚁集团开源 124B 模型,采用纯正 MIT 协议无商业限制 — Asleep-Pilot-4142 · 2026-08-06