Qwen 3.8 27B本地实测表现稳定

开发者在RTX 3090和4090上测试了Qwen 3.8 27B模型。测试显示模型在4bit量化下运行稳定,支持128K长上下文,推理速度可达37至73 tok/s,自动压缩上下文且无明显报错,本地可用性较高。

2026-08-16 ~ 2026-08-17 · 2 条相关