蚂蚁发布 124B 的 Ling-3.0-flash,API 免费到 8 月 3 日
Loose_Bank1709 · reddit · 2026-07-27
蚂蚁集团模型团队发布了 Ling-3.0-flash,一款面向生产级 agent 的混合推理 MoE 模型。
官方给出的关键信息包括:
- 总参数量 124B
- 每个 token 激活 5.1B 参数
- 上下文长度 256K
- 在公布的多数 benchmark 上,号称能以 1/8 的总参数、1/12 的激活参数追平或超过自家 1T 旗舰模型
不过这次并不是开源权重发布:目前免费的是 API 调用,而且只持续到 8 月 3 日,没有 checkpoint 可下载。对比之下,上一代 Ling-2.6-flash 曾以 MIT 许可证放出,这次的分发策略明显更偏“先免费试用,再转付费 API”。
「Infra」频道最新
- Wistron 在德州投产 7 亿美元工厂,量产 Nvidia GB300 与 Vera Rubin — Beth_Kindig · 2026-07-27
- BeeLlama.cpp 新增 KV cache 精度尾段和量化档位 — Anbeeld · 2026-07-27
- 本地跑 1 亿 token 的 GLM 5.2 只花 1 美元 — _akhaliq · 2026-07-27
- Cloudflare 的 AI training 拦截可能连 Googlebot 也挡住 — daluoseo · 2026-07-27
- 一个自托管代理把 424 个模型接到同一接口 — ranadheer535 · 2026-07-27
- 长短滑窗注意力让长上下文训练每步快 3 毫秒 — gordic_aleksa · 2026-07-27