tinygrad 在 MI300X 上跑出 MiMo-V2.6-Pro 约 200 tok/s
AIFlow_ML · x · 2026-09-23
tinygrad 宣布在 AMD MI300X 上成功 bring up MiMo-V2.6-Pro(由 GLM-5.3 引导完成),推理速度达到约 200 tok/s。这展示了 tinygrad 对 AMD 生态的持续优化,以及在非 NVIDIA 硬件上跑大模型推理的性能水平。
「Infra」频道最新
- 高盛:2026 美中 AI 资本开支差 7 倍,中国靠效率追赶 — FinanceYF5 · 2026-09-23
- 90 天连签四朵云:诺基亚 AI-RAN 战略押注单一芯片伙伴 — shashib · 2026-09-23
- FT:中国拟限制博通交换机,或占国有数据中心部署九成 — rohanpaul_ai · 2026-09-23
- 爆料:64GB 版 RTX 5090 研发中,但短期内难上市 — AIFlow_ML · 2026-09-23
- Swarm 推出 Qwen Image-2.1 推理引擎:1K 图生成仅 0.5 秒 — bingxu_ · 2026-09-23
- MTP 头被静默忽略:修复三行代码让 Mac 本地解码提速 63%-79% — Micha0827 · 2026-09-23