开源后训练框架 Halo 发布:吞吐达 TRL 2.8 倍且更省显存

_akhaliq · x · 2026-09-22

White Circle 发布开源后训练框架 Halo,定位为开源模型后训练的训练框架,称吞吐量最高可达原生 TRL 的 2.8 倍,同时峰值显存占用更低,模型权重始终保持原生 HuggingFace 格式,无需额外转换。

所属事件:White Circle 开源后训练框架 Halo,吞吐达 TRL 2.8 倍(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →