IFM 开源训练库 xLLM:tokenizer 和 chat template 可热改,千行 Jinja 不用重跑

HildeKuehne · x · 2026-09-29

IFM Lab 发布训练库 xLLM,主打灵活可变的在线数据 pipeline,支持对 chat/instruction 数据做微调:tokenizer 与数据配比可在训练中随时调整,换新 tokenizer 或 chat template 只需改配置,不用重跑数据处理。特性包括:

团队强调灵活性不是「锦上添花」:他们在训练中不断发现 chat template 的小 bug(最终 Jinja 有 1000 行),正是能快速调整 tokenizer 和 template 才让训练中途完成修复。共同作者 Hilde Kuehne 转发了这一发布。

所属事件:IFM Lab 开源 xLLM 训练库,tokenizer 与数据配比可热切换(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →