M4 Pro 48GB Mac 成功跑通 Qwen3.8-Flash-Next GGUF 量化版
JLeonsarmiento · reddit · 2026-09-28
一位用户报告在 M4 Pro 48GB 的 Mac 上,通过 Hugging Face 上的 ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF 量化版本成功本地运行 Qwen3.8-Flash-Next。其使用感受是:同尺寸的 Dense 3.8-27B 反而更快,且因量化程度更低可能效果更好。
「Infra」频道最新
- Modal 免费放出 GPU 术语小册子,Gergely 实体书抢先晒 — charles_irl · 2026-09-28
- 测算:Meta Muse 服务 1 亿日活或需 1-4GW 算力 — SuB8u · 2026-09-28
- 2007 年 $350 旧主机实测跑赢 $1500 RTX 5070,内存速度不重要? — Truth-Does-Not-Exist · 2026-09-28
- 免校准 4-bit 量化法 TQ 开源:Qwen 27B KLD 仅 0.0282 — textclf · 2026-09-28
- GPU 抵押贷款比数据中心贷款贵 1.2 个点: lender 只信活得过芯片代际的资产 — rohanpaul_ai · 2026-09-28
- Yacine 爆料:单 GPU 实现 8K 世界每秒千万帧渲染 — yacineMTB · 2026-09-28