研究发现 I2T loss 可跨 tokenizer 对比并预测生图质量
peterxichen · x · 2026-09-15
一条训练研究线程(第 6/9 条):图像到文本(I2T)loss 可能反映了联合训练的整体进度。由于所有模型都在同一个文本 token 空间内预测,I2T loss 在不同 tokenizer 之间保持可比性,而文生图(T2I)loss 则不可比。
关键结论:I2T loss 在 SFT 之后仍然有信息量,与图像生成质量和通用 VQA 性能都呈相关性,可作为衡量多模态训练进度的跨模型指标。
「研究」频道最新
- ORQA 论文:116 个职业实测 LLM 专业知识,前沿模型仅得约六成 — soumitrashukla9 · 2026-09-15
- 11 步手推变分自编码器,一笔画懂 KL 散度与重构损失 — ProfTomYeh · 2026-09-15
- 果蝇全脑连接组新发现:靠突触权重快更新导航,LLM 不会这招 — tszzl · 2026-09-15
- Hyperstition 宣称预训练成本降 62%,小模型数学击败 Qwen3 — nick_linck · 2026-09-15
- 著名生物学家 Szathmáry:AGI 繁殖速度堪比进化失控风险 — danfaggella · 2026-09-15
- 调查显示亚洲 AI 研究者对风险的担忧反而高于西方同行 — KatjaGrace · 2026-09-15