antirez 发布 qwen3.8-flash-next GGUF 量化,博主周末搭 MLX 服务器实测

challis88ocarina · reddit · 2026-09-14

Reddit 帖作者分享自己花一个周末搭好 MLX 推理服务器,并 link 到 Redis 作者 antirez 在 Hugging Face 上发布的 qwen3.8-flash-next GGUF 量化模型。帖子本身是简短的部署成果分享,实质信息在链接的模型发布:antirez 为 Qwen 系 3.8B 模型制作了 GGUF 量化版本,适合本地/端侧推理。适合关注本地部署与轻量模型的用户。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →