FastFlowLM 支持 AMD NPU 跑 Qwen 27B,解码速度仅 1 tps
TuskNaPrezydenta2020 · reddit · 2026-10-01
FastFlowLM 发布 v1.0.7,现在可以在 AMD NPU 上本地运行 Qwen 27B 模型——不过帖主自嘲解码速度只有 1 token/秒。项目开源在 GitHub 的 ROCm/FastFlowLM 仓库。
「Infra」频道最新
- a16z:五大超大规模厂商今年资本开支约 7800 亿美元,AI 建设规模已超铁路 — a16z · 2026-10-01
- Swarms Rust 基准测试:比 LangChain 快最高 440 倍 — KyeGomezB · 2026-10-01
- 印度 EtherealMachine 从零自研五轴 CNC 机床,工厂首度曝光 — RoboBalaji · 2026-10-01
- Merge Agent Handler 入驻 NVIDIA NemoClaw,凭证隔离跑企业智能体 — shensi · 2026-10-01
- Google Data Agent Kit 正式 GA:15+ 数据服务接入任意编码智能体 — rseroter · 2026-10-01
- 本地 LLM 的核心价值:你拥有 agent loop 的控制权 — ag789 · 2026-10-01