Meta 研究员分享 capi 训练技巧:按批次比例丢弃样本保住 GPU 效率

TimDarcet · x · 2026-09-09

Meta 研究员 TimDarcet 分享一个训练工程技巧:在处理变长样本丢弃时,不要用「每个样本以概率 p 被丢弃」的方式,而是改为「每个批次按比例 p 丢弃一部分」,这样张量形状保持恒定,GPU 效率不受影响。他在 Meta 的开源项目 capi(计算机视觉训练库)中就是这样实现的,并给出 model.py 链接;如果全部逻辑都在 GPU 上,编译也能顺畅通过。

所属事件:Meta 研究员分享按批次比例丢弃样本的训练提速技巧(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →