QuixiAI实现跨硬件后端运行并刷新CPU推理速度

QuixiAI近日展示了其强大的跨平台运行能力,强调同一运行时可以覆盖CUDA、Metal、ROCm、XPU、Gaudi和CPU等六类硬件后端。此外,开发者基于SYCL kernels成功将BitNet直接运行在CPU上,并利用两张B60 XPU将Qwen3.6-35b-a3b模型的推理速度提升至100 tok/s。这些进展标志着大模型在多硬件适配和CPU端高效推理方面取得了新突破。

2026-07-22 ~ 2026-07-22 · 3 条相关