开源后训练框架 Halo 发布:吞吐达 TRL 的 2.8 倍

prasenx · x · 2026-09-22

WhiteCircle 发布开源后训练(post-training)框架 Halo,用于微调开源模型:

所属事件:White Circle 开源后训练框架 Halo,宣称吞吐最高达 TRL 2.8 倍(7 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →