AMD 讲师亮相 PyTorchCon:1K+ MI355X 上实现 MXFP8 预训练扩展
PyTorch · x · 2026-09-25
PyTorchCon 北美 2026 官方预告:AMD 的 Liz Li 与 Shekhar Pandey 将介绍在 1000+ AMD Instinct MI355X GPU 上扩展 MXFP8 预训练的工作,涵盖 TorchAO 中关键 MXFP8 算子优化、与 TorchTitan 集成的端到端 LLM 训练栈,以及 Triton 和 FlyDSL 实现和数值验证、收敛、性能调优的经验。会议 10 月 20-21 日在圣何塞举行。
「Infra」频道最新
- VeriTile:用 Lean 形式化验证 Triton GPU 内核,AI 智能体自动写正确性证明 — KaiyuYang4 · 2026-09-25
- Merge Gateway 推出 Batch API,批量推理约半价 — shensi · 2026-09-25
- 工程师发文详解生产环境 LLM 推理扩容实践 — abhijithneil · 2026-09-25
- Lambda 工程师详解本地推理装机:27B 模型需 24-32GB 显存 — TheZachMueller · 2026-09-25
- Pokee AI 现场演示 36B agent 模型跑在 32GB 内存的骁龙笔记本上 — Kyrannio · 2026-09-25
- AI 能源公司 Parallax 出炉,获 Founders Fund 领投 1.17 亿美元 — graceisford · 2026-09-25