Hugging Face TRL v1.13 发布 支持百万 token 长上下文训练

Hugging Face 发布 TRL 库 v1.13 版本,官方称单节点 8 卡 H100 即可训练超过 100 万 token 长度的序列,并配套发布完整的长上下文训练指南,拆解序列变长时会出现的失效问题。该能力面向 agent 等场景,一次任务会话往往可累积数十万 token,超长上下文训练因此变得更易上手。

2026-09-13 ~ 2026-09-13 · 2 条相关