Qwen 3.8 Flash Next 实测:中端手机跑出 3.5 tok/s
dai_app · reddit · 2026-08-31
开发者通过优化和低比特量化,成功将 80GB 参数量的 Qwen 3.8 Flash Next 模型运行在仅有 12GB 内存的安卓中端手机上,速度达到 3.5 tok/s,证明了在 $400-$500 价位手机上运行大模型的可行性。
「Infra」频道最新
- 超 83% 美国人居住地距数据中心不到 2 英里 — aronchick · 2026-08-31
- Nvidia 宣布 SpaceX 将部署 Vera CPU 加速 agentic AI,Grok 采用 Vera Rubin — Beth_Kindig · 2026-08-31
- SK Hynix 印州 HBM 工厂动工,HBM4e 预计 2029 年量产 — Beth_Kindig · 2026-08-31
- Boring Company 招商困局:20倍成本优势却缺销售团队 — PTrubey · 2026-08-31
- 硬核实战:4080 显卡运行 182B Qwen 模型达 8 tok/s — Desperate-Data-3747 · 2026-08-31
- AI 正在改变能源系统的监控与运维方式 — ingliguori · 2026-08-31