DiSReg 新 LoRA 训练法:用自正则化消除触发词外的标签污染

bdsqlsz · x · 2026-09-06

hakomikan 在 TrainTrain 中新增了一种名为 DiSReg(Differential Self-Regulation)的 LoRA 训练方法,目标是解决老问题:训练角色 LoRA 时,1girl、solo 等伴随标签也被学进去,导致不写触发词角色也会被激活,多角色混用时尤其麻烦。

核心思路

文中给出了角色学习与自正则化步骤的损失函数公式,并已实现进 TrainTrain 仓库,适合做角色/风格 LoRA、需要精确触发词控制的训练者参考。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →