Ling-3.0-flash 发布:124B 参数、5.1B 激活、256K 上下文
BanghuaZ · x · 2026-07-24
AntLingAGI 发布了 Ling-3.0-flash,定位是面向生产环境的混合推理 MoE 模型,特别适合 agent 场景。
已披露的关键信息包括:
- 124B 总参数,但每个 token 只激活 5.1B 参数
- 256K 上下文长度
- 采用 KDA + MLA 的混合注意力设计
- 官方称它在展示的多数基准上,能以远少于自家 1T 旗舰模型 的总参数和激活参数规模,达到相当甚至更好的成绩
SGLang 方面表示,正在和团队合作推进该模型的 day-0 支持。
所属事件:Ling-3.0-flash 混合推理模型发布并免费开放(5 条相关)→
「编程与Agent」频道最新
- AI 写测试的两大失败点:误解上下文与测试质量差 — dotey · 2026-07-24
- 独立开发者做了个给 AI agent 的 webhook 层 — Majoris_25 · 2026-07-24
- 一张新图谱梳理了 11 套编码基准里的 2226 个任务 — zainhas · 2026-07-24
- Poolside 公开评测数据,CEO 说代码是通往 AGI 的路径 — eliebakouch · 2026-07-24
- Agent 开始在执行任务时主动暴露产品缺口 — stuffyokodraws · 2026-07-24
- 多智能体聊天室实验:让 AI 代理自主交流与研究 — basedjensen · 2026-07-24