受 Jev 启发的推理方案:350M 小模型提速 63 倍,代码权重已开源

JosephJacks_ · x · 2026-09-20

开发者尝试用 Jev 风格的推理方式改造 LFM2.5-350M:不做训练,仅靠并行决策实现推理加速。实测在 L40S GPU 上比原推理快 63 倍,在苹果 MPS 上快 8 倍。代码和权重已发布在 Hugging Face 上,可自行复现。

所属事件:并行结构化推理让 350M 小模型提速 63 倍,代码开源(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →