端侧MoE模型实测:NVIDIA Lightning比Qwen快2.5倍

parepeg · reddit · 2026-08-12

作者基于 Artificial Analysis 的数据和 llama.cpp 的本地测试,对比了 NVIDIA Lightning (30B) 与 Qwen3.6 (35B) 两款 MoE 模型的表现。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →