Ling-3.0-flash 发布:124B 参数、5.1B 激活、256K 上下文
BanghuaZ · x · 2026-07-24
AntLingAGI 发布了 Ling-3.0-flash,定位是面向生产环境的混合推理 MoE 模型,特别适合 agent 场景。
已披露的关键信息包括:
- 124B 总参数,但每个 token 只激活 5.1B 参数
- 256K 上下文长度
- 采用 KDA + MLA 的混合注意力设计
- 官方称它在展示的多数基准上,能以远少于自家 1T 旗舰模型 的总参数和激活参数规模,达到相当甚至更好的成绩
SGLang 方面表示,正在和团队合作推进该模型的 day-0 支持。
所属事件:蚂蚁推出124B参数MoE模型Ling-3.0-flash(12 条相关)→
「编程与Agent」频道最新
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11