InclusionAI 发布 LLaDA-Image:6B 全扩散架构,90% 训练只用图片

jiqizhixin · x · 2026-09-16

蚂蚁系 Inclusion AI 发布 LLaDA-Image,一个从头训练的 6B 参数全扩散架构 DiT:后端与生成均为扩散模型。核心思路是在预训练和中训阶段仅用图片学习视觉先验——2.2 亿累计生成训练样本中超过 90% 为纯图像监督、不用 caption,图文对仅保留给后期语言对齐阶段,从而绕开高质量 caption 稀缺昂贵这一瓶颈。一套权重同时支持文本生成图像等多种任务。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →