QuixiAI实现跨硬件后端运行并刷新CPU推理速度
QuixiAI近日展示了其强大的跨平台运行能力,强调同一运行时可以覆盖CUDA、Metal、ROCm、XPU、Gaudi和CPU等六类硬件后端。此外,开发者基于SYCL kernels成功将BitNet直接运行在CPU上,并利用两张B60 XPU将Qwen3.6-35b-a3b模型的推理速度提升至100 tok/s。这些进展标志着大模型在多硬件适配和CPU端高效推理方面取得了新突破。
2026-07-22 ~ 2026-07-22 · 3 条相关
- QuixiAI 展示同一运行时覆盖 CUDA 到 CPU 六类后端 — QuixiAI · 2026-07-22
- Qwen3.6-35b-a3b 用两张 B60 XPU 跑到 100 tok/s — QuixiAI · 2026-07-22
- BitNet 跑上 CPU,Qwen3.6-35B 双 B60 达 100 tok/s — QuixiAI · 2026-07-22