蚂蚁 inclusionAI 发布 Ling-3.0-flash:124B 参数、256K 上下文
Loose_Bank1709 · reddit · 2026-07-25
蚂蚁集团旗下 inclusionAI 推出 Ling-3.0-flash,这是一个总参数 124B、激活参数约 5.1B 的稀疏 MoE 模型,支持 256K 上下文,并宣称 首 token 延迟低于 100ms。
帖子强调它的定位非常明确:不是前沿推理模型,而是给 agent 工作流配套的“执行节点”。它支持混合推理模式,主打稳定的长程工具调用和指令遵循;同时也指出它的取舍是:深域知识和原生多模态并非强项。该模型目前 仅 API 可用,已上架 OpenRouter,并在 8 月 3 日前免费。
所属事件:蚂蚁 Ling-3.0-flash 发布:124B MoE 面向生产级 Agent(11 条相关)→
「编程与Agent」频道最新
- 自治 Agent 上线后,团队怎么拦住它们乱烧 API 账单 — Odd_Weather_3289 · 2026-07-25
- 开发者因高频使用 Codex,为 Linux 支持提 PR — cneuralnetwork · 2026-07-25
- 免费 MCP 连接器把亚马逊 CPG 定价情报接入 AI 工作流 — modelcontextprotocol · 2026-07-25
- Todoist MCP 服务器让 AI 助手直接管理任务和项目 — modelcontextprotocol · 2026-07-25
- 一个 GUI 工具箱把 Python 环境、依赖和 AI 接口放一起管 — Kinda-Brazy · 2026-07-25
- 拿到 kbd-1.0-codex-micro 访问,OpenAI 编码键盘现身 — zbeyens · 2026-07-25