Ling 3.0 Tiny 实测:4G 显存跑出 36 token/s,媲美 Qwen 9B
cosmos_hu · reddit · 2026-08-18
用户在 4GB 显存的旧电脑上实测 Ling 3.0 Tiny:8B 总参数、1.3B 激活,生成速度达约 36 token/s,而同机上的 Qwen 3.5 9B 只有约 5 token/s。作者认为其智力水平与 Qwen 3.5 9B / Gemma 12 相当接近,且速度体验好得多,是目前低配 PC 上最强的开源小模型之一。
所属事件:Ling 3 Tiny 实测:4G 显存跑 36 token/s 媲美 Qwen 9B(2 条相关)→
「模型」频道最新
- Qwen3.8 对比 27B:推理更慢但结果更优 — surreal_tournament · 2026-08-19
- 训练 agent 的诀窍:逼它一直向前倒,代价是学会克制更难 — generativist · 2026-08-19
- DeepSeek V4 神级框架被证伪:J-Space 测评涉嫌造假 — bookwormengr · 2026-08-19
- 平台 AIWayfinder 统计:DeepSeek 占 79.4% Token 消耗 — templecrash · 2026-08-18
- DeepSeek v4 本地部署优化:预填充速度飙至 3000 t/s — antirez · 2026-08-18
- Anthropic 员工独享重置额度功能,开发者眼红 — testingcatalog · 2026-08-18