CPU 本地跑模型实测:35B MoE 量化版胜过 2B 小模型

ML-Future · reddit · 2026-09-08

楼主讨论本地 LLM 的未来:是走"超智能小模型"还是"超高效率大模型"路线,并分享了纯 CPU 实测数据。

作者此前还发过 Qwen3.6 35B 无 GPU 可用的详细帖。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →