字节 Seed 提出 RWTD:一步生成模型后训练,GenEval 0.73→0.80

ByteDance-Seed · hf · 2026-10-02

字节跳动 Seed 团队提出 Reward-Weighted Transport Distillation (RWTD),一种只需生成样本和标量奖励评估的一步生成模型后训练方法:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →