蚂蚁 InclusionAI 推出 Ling-3.0-flash,主打便宜快速执行
AcanthisittaOk1699 · reddit · 2026-07-25
这条 Reddit 贴在说 蚂蚁集团 InclusionAI 新推出了便宜、快速的执行模型 Ling-3.0-flash,而且还免费开放一周。
- 该模型被描述为稀疏 MoE:总参数 124B / 激活 5.1B,支持 256K 上下文,首 token 延迟可低至 100ms 以内。
- 设计定位很明确:把它当成工具调用和高频机械步骤的“便宜快执行节点”,而把更大的模型留给真正的推理。
- 贴主补充说它目前是 API-only,还没有开源权重;上一代 Ling-2.6-flash 曾是 MIT 许可。
- 他也在追问:这波“便宜快模型”洪流,最终会把行业带向什么样的分工结构。
所属事件:Ling-3.0-flash 发布:主打 Agent 场景与超长免费期(10 条相关)→
「Infra」频道最新
- AI 需求推高 DRAM 合约价 171.8%,回落或要等到 2028 — 量子位 · 2026-07-25
- 可复现后端要连 GPU 和 CPU 一起迁移,商业模式仍不清晰 — omojumiller · 2026-07-25
- 文档解析器选型先看版面和扫描质量,不要先看榜单 — emmettvance · 2026-07-25
- NURL 逼近 v1.0:面向 LLM 工作流的单二进制语言 — AdhesivenessHappy873 · 2026-07-25
- Anthropic 公开与三星、SK hynix 签署供应协议 — dejavucoder · 2026-07-25
- OpenAI 登录失败后持续报 `primaryapi_server_error` — HaselnuesseTo · 2026-07-25