研究发现 I2T loss 可跨 tokenizer 对比并预测生图质量

peterxichen · x · 2026-09-15

一条训练研究线程(第 6/9 条):图像到文本(I2T)loss 可能反映了联合训练的整体进度。由于所有模型都在同一个文本 token 空间内预测,I2T loss 在不同 tokenizer 之间保持可比性,而文生图(T2I)loss 则不可比。

关键结论:I2T loss 在 SFT 之后仍然有信息量,与图像生成质量和通用 VQA 性能都呈相关性,可作为衡量多模态训练进度的跨模型指标。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →