antirez 发布 qwen3.8-flash-next GGUF 量化,博主周末搭 MLX 服务器实测
challis88ocarina · reddit · 2026-09-14
Reddit 帖作者分享自己花一个周末搭好 MLX 推理服务器,并 link 到 Redis 作者 antirez 在 Hugging Face 上发布的 qwen3.8-flash-next GGUF 量化模型。帖子本身是简短的部署成果分享,实质信息在链接的模型发布:antirez 为 Qwen 系 3.8B 模型制作了 GGUF 量化版本,适合本地/端侧推理。适合关注本地部署与轻量模型的用户。
「Infra」频道最新
- Oracle 大裁员同时狂招数据中心与 AI 人才,团队被砍两位数比例 — mkheck · 2026-09-14
- Strix Halo 128GB 双 GPU 同跑两模型遇 OOM,参数全公开 — El_90 · 2026-09-14
- 马斯克:四五年内 AI 将占 SpaceX 价值的 99% — XFreeze · 2026-09-14
- HBM 与先进封装企业需求或降温,DRAM/NAND 价格有望回归正常 — eyishazyer · 2026-09-14
- Depot 详解如何在 GitHub 之外运行 GitHub Actions 流水线 — jcran · 2026-09-14
- LangSmith 推出 LLM Gateway:可按密钥锁定可用模型 — LangChain · 2026-09-14