Qwen3.5 2B/4B/9B 纯文本 MLX 4-bit 包发布,最小仅 1GB
sachasayan · reddit · 2026-10-09
Reddit 用户整理发布了 Qwen3.5 的纯文本(去视觉)MLX 4-bit 本地运行包,共六个:2B、4B、9B 各有原版与 Huihui abliterated(去审查)版本,专为 Apple Silicon 本地推理优化,2B 版仅约 1GB,适合后台低占用常驻。作者已将其用于自己的写作软件 Minstrel 做摘要与上下文判断任务,模型包已在 Hugging Face 开放下载,致谢 Qwen、Huihui 及社区转换作者。
「模型」频道最新
- 开源权重≠开源:开发者主张改用 open-weight 措辞 — kipperrii · 2026-10-09
- ChatGPT 编造判例致律师被停职,视频复盘 AI 幻觉司法翻车 — dadakoglu · 2026-10-09
- 用户实测:Qwen3.8 跑 Hermes 自主配置电脑备考 CPA,数月拖延一次搞定 — natesiggard · 2026-10-09
- 用户实测:GPT-6 网页研究比 5.6 快约 10 倍 — flowersslop · 2026-10-09
- FineWeb 作者:用 27B 模型标注预训练数据很疯狂,但通用模型更省部署 — antoine_chaffin · 2026-10-09
- Hugging Face 作者谈小模型:大规模任务要吞吐量,微调小模型仍是王道 — antoine_chaffin · 2026-10-09