Qwen 3.8 Flash Next 实测:中端手机跑出 3.5 tok/s

dai_app · reddit · 2026-08-31

开发者通过优化和低比特量化,成功将 80GB 参数量的 Qwen 3.8 Flash Next 模型运行在仅有 12GB 内存的安卓中端手机上,速度达到 3.5 tok/s,证明了在 $400-$500 价位手机上运行大模型的可行性。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →