Qwen3.6-35b-a3b 用两张 B60 XPU 跑到 100 tok/s
QuixiAI · x · 2026-07-22
- QuixiAI 表示,自己已经把 Qwen3.6-35b-a3b nvfp4 跑到了 100 tok/s。
- 这套配置使用的是 2× B60 XPU,并且依赖自写的 SYCL kernels。
- 这是一条很具体的性能数据,说明一个较大的 Qwen 模型已经能在 XPU 硬件上跑出不错吞吐。
所属事件:QuixiAI实现跨硬件后端运行并刷新CPU推理速度(3 条相关)→
「Infra」频道最新
- Unsloth 推出 Laguna S 2.1 的 GGUF 量化版 — BoogerheadCult · 2026-07-22
- 核电或将影响 2028 年后 AI 基建,中美占 2050 容量大头 — tengyanAI · 2026-07-22
- 马克·库班称更便宜的 AI 可能让数据中心空到能打匹克球 — AIFlow_ML · 2026-07-22
- 东方算芯 DF1000 宣称 520 TFLOPS BF16 和 6.4TB/s 带宽 — teortaxesTex · 2026-07-22
- QuixiAI 展示同一运行时覆盖 CUDA 到 CPU 六类后端 — QuixiAI · 2026-07-22
- Meta 基础设施被指为局部最优浪费芯片,代价上十亿美元 — dylan522p · 2026-07-22