Qwen3.8-27B 本地引擎实测:MTPLX 综合最强
ex-arman68 · reddit · 2026-08-24
作者花费 5 天和 100 GPU 小时,在 Mac Studio M2 Max 上对 Qwen 3.8 27B 进行了严格的 Agent 编程基准测试。测试对比了 MTPLX、llama.cpp、mlx-dspark 等多种引擎在 medium 和 xhigh 推理模式下的表现。结论显示,MTPLX 在解码速度和任务得分上综合最佳;llama.cpp + MTP 在 medium 模式下最快;而 oMLX 和 vllm-mlx 表现较慢。此外,在引擎足够快的情况下,xhigh 模式带来的质量提升值得额外的时间成本。
「Infra」频道最新
- 三星详解定制 HBM:在先进节点构建基 Die 的七大优势 — BenBajarin · 2026-08-24
- 定制 HBM 基 Die 正成为三大存储巨头的竞争优势 — BenBajarin · 2026-08-24
- 三星演示抨击美光 HBM4 基础芯片设计 — zephyr_z9 · 2026-08-24
- 车辆贴纸能躲避 Flock 摄像头识别吗? — HankYeomans · 2026-08-24
- 曝 Feynman Ultra 显存带宽或达 100TB/s — zephyr_z9 · 2026-08-24
- zHBM 被视为低功耗算力未来 — ricklamers · 2026-08-24