TRL v1.13 发布:单节点 8 卡 H100 可训练超 100 万 token 序列

SergioPaniego · x · 2026-09-13

Hugging Face TRL 库发布 v1.13 版本,支持训练超过 100 万 token 长度的序列,并配套发布了完整指南。核心场景:agent 一次任务会话可累积数十万 token,要让模型真正擅长超长上下文,就必须在同样长的序列上训练——但百万 token 序列连 8 张 GPU 都装不下。指南展示了在单个 8-GPU 节点(8×H100)上每步训练一条完整百万 token 序列的做法,依赖 transformers main 分支的 gradient checkpointing offload 新特性(尚未进入正式版)。

所属事件:Hugging Face TRL v1.13 发布 支持百万 token 长上下文训练(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →