蚂蚁发布 Ling-3.0-flash:124B 参数仅激活 5.1B

SonglinYang4 · x · 2026-07-25

蚂蚁 Ling 团队发布了专为生产级智能体打造的混合推理 MoE 模型 Ling-3.0-flash。该模型总参数量为 124B,但每个 token 仅激活 5.1B 参数。官方称,凭借仅 1/8 的总参数和 1/12 的激活参数,该模型在大部分基准测试中能够媲美甚至超越其 1T 参数量的旗舰模型。此外,vLLM 团队也发文赞赏了其“先发布后开源”的策略,认为这为开源推理框架提供了稳定的测试窗口。

所属事件:蚂蚁推出124B参数MoE模型Ling-3.0-flash(12 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →