Ling 3.0 Tiny 对比 Gemma 26B:显存小 3 倍,任务准确率却腰斩

autonoma_2042 · reddit · 2026-09-21

一位开发者在有声书管线(为小说对白分配说话人供 TTS 配音)中,把 Ling 3.0 Tiny(7.9B 总参/1.3B 激活,Q4 约 4.8GB,可整卡塞进 8GB VRAM) 与现任 Gemma 4 26B-A4B(QAT Q4,14GB,专家驻留内存) 做了同任务 A/B 实测:

结果:在 485 行人工校准的对白归属基准上,Gemma 总体 94.6%(最差章节 90.6%),Ling 仅 56.9%(最差章节 43.8%),且章节越长差距越大;Gemma 单章耗时也更短。

结论:Ling 3.0 Tiny 虽然显存占用和吞吐漂亮,但在这种严格 JSON 抽取任务上与 26B MoE 差距悬殊,小显存优势换不来质量。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →