TRL v1.15 融合 LM head,峰值显存省 82%、序列长 7 倍
QGallouedec · x · 2026-10-09
Hugging Face TRL 发布 v1.15,官方称之为史上最大优化。默认开启的 Fused LM head 带来:峰值 VRAM 最高降低 82%、可训练序列长度提升 7 倍;DPO 可处理序列从 10k 增至 59k tokens,GRPO 从 29k 增至 115k tokens。
「Infra」频道最新
- 被收购两年半后,PartyKit 宣布关停免费托管平台 — threepointone · 2026-10-09
- 3090+3060 本地跑视频生成选哪个模型?wan2.2 还是 minimax h3 — itspacedev · 2026-10-09
- 三星季营业利润预计暴涨 780%,AI 热潮下 DGX Spark 内存之谜有解 — chemist_slime · 2026-10-09
- 在核显上跑 22B 视频模型 LTX-2.5:权重留 NVMe 逐层流式加载 — Business_Swordfish_5 · 2026-10-09
- 亚太数据中心缺口 2800 亿美元,柔佛成最大新建市场 — shashib · 2026-10-09
- Stepped MoE 论文:单个模型可缩放为 1-4B,端侧精度反超同级稠密模型 — pmttyji · 2026-10-09