蚂蚁发布 Ling-3.0-flash:124B 参数仅激活 5.1B
SonglinYang4 · x · 2026-07-25
蚂蚁 Ling 团队发布了专为生产级智能体打造的混合推理 MoE 模型 Ling-3.0-flash。该模型总参数量为 124B,但每个 token 仅激活 5.1B 参数。官方称,凭借仅 1/8 的总参数和 1/12 的激活参数,该模型在大部分基准测试中能够媲美甚至超越其 1T 参数量的旗舰模型。此外,vLLM 团队也发文赞赏了其“先发布后开源”的策略,认为这为开源推理框架提供了稳定的测试窗口。
所属事件:蚂蚁推出124B参数MoE模型Ling-3.0-flash(12 条相关)→
「模型」频道最新
- 5p6 Sol Extra High 模型被指患有“拖延症” — RylanSchaeffer · 2026-08-05
- DeepSeek订阅额度极限压测:性价比能否超越Gemini? — teortaxesTex · 2026-08-05
- 128GB 内存 Mac 跑本地大模型,哪款最适合写代码? — Electronic_Back1502 · 2026-08-05
- 开源模型遇瓶颈:长周期智能体任务表现拉胯 — bindureddy · 2026-08-05
- 开发者称 Gemini 3.6 Flash 迭代 10 次胜过等 Qwen 3.8 max 两小时 — DynamicWebPaige · 2026-08-05
- 投资人暗示 Black Forest Labs 将发布 FLUX 3 — venturetwins · 2026-08-05