InclusionAI 发布 LLaDA-Image:6B 全扩散架构,90% 训练只用图片
jiqizhixin · x · 2026-09-16
蚂蚁系 Inclusion AI 发布 LLaDA-Image,一个从头训练的 6B 参数全扩散架构 DiT:后端与生成均为扩散模型。核心思路是在预训练和中训阶段仅用图片学习视觉先验——2.2 亿累计生成训练样本中超过 90% 为纯图像监督、不用 caption,图文对仅保留给后期语言对齐阶段,从而绕开高质量 caption 稀缺昂贵这一瓶颈。一套权重同时支持文本生成图像等多种任务。
「模型」频道最新
- ChatGPT 联合发明者推出决策型模型 Jev:快 200 倍、便宜 400 倍但不能写字 — TianbaoX · 2026-09-16
- 开发者感叹:动态输入 200ms 内稳定结构化输出成真 — blixt · 2026-09-16
- Apodex 1.1 用真实临床数据跑生存分析:从原始表格到 Kaplan-Meier 曲线 — aakashgupta · 2026-09-16
- Apodex 发布 1.1:从研究问答转向真实任务执行 — testingcatalog · 2026-09-16
- 独立开发者开源 Qwen-2.5-1B-RLCD,端侧 JSON 推理提速 5 倍 — suchenzang · 2026-09-16
- GPT-5.6 Sol 一句 Are you sure 就翻转结论,推理可信度存疑 — Sockand2 · 2026-09-16