实测:Qwen 3.8 Flash Next 在低配硬件上的表现
Agitated_Force_9199 · reddit · 2026-08-28
作者在 Ubuntu 系统下(16GB 系统内存 + 6GB 显存)使用 llama.cpp 运行 Qwen 3.8 Flash Next (1-bit quant),获得了稳定的 6-7 tps。作者对该体验表示满意,并寻求关于更优量化版本的建议,以在速度和质量间取得平衡。
「Infra」频道最新
- 英伟达 Q2 营收 300 亿美元,未来承诺支出飙升至 3660 亿 — GaryMarcus · 2026-08-28
- Acorn:运行在你服务器的 AI 幕僚长 — MatthewChang · 2026-08-28
- 工会蓝领反推反对数据中心建设,强调就业机会 — MatthewBerman · 2026-08-28
- 英国工党拒绝暂停 AI 数据中心建设,称其关乎就业与国安 — nordicinst · 2026-08-28
- a16z 筹集 11 亿美元基金,专注 AI 物理基础设施建设 — appenz · 2026-08-28
- llama.cpp mmap 实测:16G+64G 内存跑 Qwen3.8-Flash-Next 达 26t/s — q8019222 · 2026-08-28