Qwen3.8 变体实测:8 位量化显存占用降 27%

EyalToledano · x · 2026-08-28

发布了两个基于 Qwen3.8-Flash-Next-REAP 的 MLX 量化变体。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →