Ling-3.0-tiny 发布:1.3B 活跃参数跑赢 GPT-OSS 120B
solyarisoftware · x · 2026-08-11
Ling-3.0-tiny 是一款专为推理、工具调用和智能体设计的开源模型。它采用 128 专家稀疏 MoE 架构,总参数 7.9B,但每 token 激活参数仅 1.3B。
- 性能跑分:在 Artificial Analysis 上表现优异,GPQA Diamond 得分 73.4,IMO-AnswerBench 达到 71.0,以极小体量超越了 OpenAI 的 GPT-OSS 120B (high)。
- 本地部署:提供 BF16、FP8 和 INT4 多种权重。其中 INT4 版本仅需约 5.8GB 内存,FP8 在 8K 上下文峰值内存约 8.34 GiB。
- 推理速度:在 DGX Spark 上可达约 100-105 tok/s,在 M4 Pro MacBook 上约为 86-90 tok/s。
- 运行支持:目前已支持 SGLang、vLLM 以及 Apple Silicon 的 MLX,llama.cpp / LM Studio 等工具尚待跟进。
所属事件:蚂蚁开源Ling-3.0-tiny超小型MoE大模型(3 条相关)→
「Infra」频道最新
- 仅花200美元从零训练1B参数大模型,作者全开源训练细节 — SevereTilt · 2026-08-11
- AI网关与模型路由需求激增,成行业新热点 — shensi · 2026-08-11
- OpenAI 致信德州州长,阐述负责任 AI 基础设施建设愿景 — borowcy · 2026-08-11
- 实测 DGX Spark 运行 H3:ComfyUI 文生视频初探 — allaboutai-kris · 2026-08-11
- 中国首款国产前道光刻机投产,性能对标 90 年代 ASML — pstAsiatech · 2026-08-11
- 不足10%企业规模化落地AI,算力短缺将长期制约 — BenBajarin · 2026-08-11