d-Matrix 芯片宣称实现 Qwen 推理 20 倍加速
TheKanter · x · 2026-08-12
文章讨论了 d-Matrix 的 Corsair 芯片在 AI 推理任务中的表现。据称通过与 Infinity 的系统优化合作,该芯片在运行 Qwen 3 模型时,相比传统方案实现了每秒 20 倍的 token 生成速度提升,展现了挑战英伟达垄断地位的潜力。
「Infra」频道最新
- 推理与智能体爆发:AI Token 消耗量半年激增 14 倍 — robleclerc · 2026-08-12
- SGLang 实现本地高效运行 Nemotron 3.5:支持 1M 上下文 — BanghuaZ · 2026-08-12
- 单卡24GB实测:投机解码让30B模型提速至84 tok/s — iam31337 · 2026-08-12
- 实测:AWS Graviton 单核内存读取速度达 Intel Xeon 三倍 — lemire · 2026-08-12
- LangChain 实测:仅 7% 调用需前沿模型,路由降本 74% — colinmcnamara · 2026-08-12
- AI基础设施交易 booming:相关企业营收呈近三位数增长 — firstadopter · 2026-08-12