PyTorch 2.13 发布:FlexAttention 登陆苹果芯片,大词表显存暴降 4 倍
PyTorch · x · 2026-08-01
PyTorch 2.13 正式发布,带来多项关键性能优化与功能拓展:
- 硬件与显存优化:FlexAttention 正式支持 Apple Silicon;针对大词表模型引入 nn.LinearCrossEntropyLoss,最高可削减 4 倍峰值显存。
- 计算加速:FlexAttention 可针对特定 masking 模式编译专用内核以跳过冗余计算,在测试的稀疏配置中速度较 SDPA 提升约 12 倍;同时在 CUDA 上提供确定性的反向传播路径,消除了梯度计算中的不确定性。
- 生态更新:全面升级了分布式训练、编译器、性能分析器及端侧推理(on-device inference)组件。
官方同步举办了 Live Q&A 活动,探讨了 CUDA 版本支持、CuTeDSL、Python 3.15 以及 PyTorch 2.14 的后续规划。
所属事件:PyTorch 2.13 发布:支持苹果芯片并大幅优化显存(2 条相关)→
「Infra」频道最新
- a16z:AI 基础设施需求有增无减,供应链瓶颈成产业制约 — a16z · 2026-08-01
- Together AI 深度解析:LLM 推理自动扩缩容避坑指南 — togethercompute · 2026-08-01
- Vercel AI Gateway 支持团队与项目级预算上限 — cramforce · 2026-08-01
- 特斯拉签下469兆瓦太阳能协议,提前数年锁定AI算力电力 — XFreeze · 2026-08-01
- DGX Spark 本地部署:Qwen 3.5 122B 后的模型升级选择探讨 — Voxandr · 2026-08-01
- 分析师路透:Equinix圣何塞园区扩建约200MW — BenBajarin · 2026-08-01