BitNet 跑上 CPU,Qwen3.6-35B 双 B60 达 100 tok/s
QuixiAI · x · 2026-07-22
- 作者称 BitNet 已经可以直接在 CPU 上运行,并强调这件事“很大”。
- 随后补充:自己用 SYCL kernels,让 Qwen3.6-35B-A3B NVFP4 在 2× B60 XPU 上跑到了 100 tok/s。
- 这条更像是在展示低比特模型推理与硬件/内核优化能力,而不是单纯的模型发布。
所属事件:QuixiAI实现跨硬件后端运行并刷新CPU推理速度(3 条相关)→
「Infra」频道最新
- Gigatoken 号称比 Hugging Face 分词器快 500 到 1000 倍 — ZainHasan6 · 2026-07-22
- 英国数据中心扩张撞上供水争议,关键基础设施地位成焦点 — Sure_Ad_9884 · 2026-07-22
- NVIDIA Rubin 引入 tile 级依赖触发提升 kernel 重叠 — Moh1tAgarwal · 2026-07-22
- 广告牌称某公司 9 个月可交付 AI 数据中心 — BenBajarin · 2026-07-22
- 印度芯片工厂仍高度依赖进口超纯化学品 — santoshpanda · 2026-07-22
- Sakana AI 联手 NVIDIA:新方法减少 LLM 数据浪费 — SakanaAILabs · 2026-07-22