FastFlowLM 支持 AMD NPU 跑 Qwen 27B,解码速度仅 1 tps

TuskNaPrezydenta2020 · reddit · 2026-10-01

FastFlowLM 发布 v1.0.7,现在可以在 AMD NPU 上本地运行 Qwen 27B 模型——不过帖主自嘲解码速度只有 1 token/秒。项目开源在 GitHub 的 ROCm/FastFlowLM 仓库。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →