Hugging Face TRL v1.13 发布 支持百万 token 长上下文训练
Hugging Face 发布 TRL 库 v1.13 版本,官方称单节点 8 卡 H100 即可训练超过 100 万 token 长度的序列,并配套发布完整的长上下文训练指南,拆解序列变长时会出现的失效问题。该能力面向 agent 等场景,一次任务会话往往可累积数十万 token,超长上下文训练因此变得更易上手。
2026-09-13 ~ 2026-09-13 · 2 条相关
- HuggingFace TRL v1.13 发布,支持百万 token 长上下文训练 — SergioPaniego · 2026-09-13
- TRL v1.13 发布:单节点 8 卡 H100 可训练超 100 万 token 序列 — SergioPaniego · 2026-09-13