蚂蚁 inclusionAI 发布 Ling-3.0-flash:124B 参数、256K 上下文
Loose_Bank1709 · reddit · 2026-07-25
蚂蚁集团旗下 inclusionAI 推出 Ling-3.0-flash,这是一个总参数 124B、激活参数约 5.1B 的稀疏 MoE 模型,支持 256K 上下文,并宣称 首 token 延迟低于 100ms。
帖子强调它的定位非常明确:不是前沿推理模型,而是给 agent 工作流配套的“执行节点”。它支持混合推理模式,主打稳定的长程工具调用和指令遵循;同时也指出它的取舍是:深域知识和原生多模态并非强项。该模型目前 仅 API 可用,已上架 OpenRouter,并在 8 月 3 日前免费。
所属事件:蚂蚁推出124B参数MoE模型Ling-3.0-flash(12 条相关)→
「编程与Agent」频道最新
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11