HuggingFace TRL v1.13 发布,支持百万 token 长上下文训练

SergioPaniego · x · 2026-09-13

HuggingFace 发布 TRL v1.13,带来超长上下文训练支持,官方称现在可以用它训练超过 100 万 token 序列的模型。

新增长上下文指南,拆解序列变长时会坏掉的四件事:损失计算、位置编码、激活值和单卡显存,并给出完整示例——在一个 8 GPU 节点上用百万 token 序列训练 Qwen3-8B。

TRL 是用于强化学习后训练基础模型的开源库,GitHub 已有约 19.3k star。

所属事件:Hugging Face TRL v1.13 发布 支持百万 token 长上下文训练(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →