liuliu 提醒:宣称比 MLX/llama.cpp 快 4-10 倍的定制推理引擎多为噪声
teortaxesTex · x · 2026-09-23
研究者 liuliu 跟进此前观点:Apple 硬件上凡是宣称比 @awnihannun 的 MLX 或 @ggerganov 的 llama.cpp 快 4 倍、8 倍、10 倍的「定制/模型专用推理引擎」,都应对其保持怀疑——这类数字多为噪声,可信度很低。
「Infra」频道最新
- SemiAnalysis 实测 Engram DRAM offloading 性能提升最高 50% — bookwormengr · 2026-09-23
- 测算:DeepSeek DSec 集群单套物料约 2000 万美元,10 亿美元可建 50 套 — teortaxesTex · 2026-09-23
- B200 租赁价创新高,GPU 时租均价升至 7.88 美元 — sudoraohacker · 2026-09-23
- ASML 欧洲客户新设备交付为零,韩国独占 43% — FinanceYF5 · 2026-09-23
- 自定义融合采样器 kernel 让 DiffusionGemma 在 vLLM 上再快 15% — imjustnewatai · 2026-09-23
- 装机实测:一个风扇方向错了,双 GPU 从 85°C 降到 78°C — HankYeomans · 2026-09-23