liuliu 提醒:宣称比 MLX/llama.cpp 快 4-10 倍的定制推理引擎多为噪声

teortaxesTex · x · 2026-09-23

研究者 liuliu 跟进此前观点:Apple 硬件上凡是宣称比 @awnihannun 的 MLX 或 @ggerganov 的 llama.cpp 快 4 倍、8 倍、10 倍的「定制/模型专用推理引擎」,都应对其保持怀疑——这类数字多为噪声,可信度很低。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →