13.1GB 显存跑 Qwen 27B:Shapelearn 量化部署实测
syntaxing · hn · 2026-09-18
Byteshape 博客介绍 Shapelearn 方案,在仅 13.1GB 显存条件下运行 Qwen 3.8 27B 模型,属于本地/端侧部署的量化与显存优化实践。
「Infra」频道最新
- M4 每周期可执行 10 条指令,超多数竞品,M5 提速另有玄机 — lemire · 2026-09-19
- Apple M6 核心数增至12,作者解析CPU仍在快速进步 — lemire · 2026-09-19
- Apple M2 到 M5 三年性能提升约 50%, gradual 无跳跃式增长 — lemire · 2026-09-19
- Daniel Lemire 拆解 Apple M2→M5:主频提升 30% 是性能主因 — lemire · 2026-09-19
- OpenAI 揭秘推理路由:比例控制器为何换成全局优化器 — AI Engineer · 2026-09-19
- DGX Spark 双机太贵,本地 AI 硬件 affordability 引热议 — FlolightC · 2026-09-19