PyTorch 运行时 TRANSIT:大模型训练可省 50% 显卡

PyTorch · x · 2026-08-26

TRANSIT (TRANsparent Scale-In for multi-node Training) 是一个新的运行时,使统一虚拟内存在大规模 LLM 训练中变得实用。它能够在不修改现有 PyTorch 训练代码的情况下,使模型训练所需的 GPU 数量减少多达 50%。相关研究将在 PyTorch Conference North America 上以海报形式展示。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →