TRL v1.15 发布:新 Triton 内核让 SFT/RL 单卡扩到 10 万+ token
_lewtun · x · 2026-10-11
Hugging Face 的 Lewis Tunstall 提醒 TRL 用户升级到 v1.15:新 Triton 内核可在同一块 GPU 上把 SFT/RL 训练的序列长度扩展到超过 10 万 token,显著提升单卡长序列训练能力。
所属事件:TRL v1.15 发布:融合 LM head 默认开启,单卡长序列训练大幅扩容(6 条相关)→
「Infra」频道最新
- a16z:Agent 耗 token 是人类 5 倍,半年涨 14 倍 — GregCook2011 · 2026-10-11
- 同码库实测:Telnyx 托管 GLM 比 OpenAI 便宜 9% 快 5% — SucceededMind · 2026-10-11
- 黄仁勋不满实验室自研芯片,NVIDIA 或正面迎战前沿实验室 — pzakin · 2026-10-11
- 本地跑 Qwen 27B 换 Flash Next:RTX 5090 用户谈模型升级取舍 — MasterNomie · 2026-10-11
- AirLLM 逐层推理:4GB 显存跑 70B 模型,8GB 可上 405B — JensHonack · 2026-10-11
- 5090+32GB 内存能逼近 Codex 多少?网友求解本地编码智能体配置 — GooseEggs712 · 2026-10-11