蚂蚁开源 LLaDA-Image:6B 扩散模型配 Muon 优化器达开源 SOTA
inclusionAI · hf · 2026-09-04
inclusionAI 发布 LLaDA-Image,将 6B 扩散 Transformer 与冻结的视觉-语言模块统一,通过纯图像预训练和 Muon 优化器生成照片级图像并支持精确编辑。
模型还蒸馏出 2-4 步快速生成变体,称达到开源图像生成的一流水平,并公开完整训练配方。
所属事件:蚂蚁 inclusionAI 开源 LLaDA-Image 图像生成模型(2 条相关)→
「多模态」频道最新
- Garry Tan 用 Grok 生成龙虾装照片当新头像 — garrytan · 2026-09-04
- muse spark 1.3 展示3D实力:多截图复刻《匹诺曹谎言》机械心脏 — alexandr_wang · 2026-09-04
- GPT-6 演示视频获 Sam Altman 点赞,但被指少了指物手势交互 — tianshi_li · 2026-09-04
- Higgsfield 推 Genjutsu:整帧级运动控制,复刻表演镜头与剪辑 — LexiLove · 2026-09-04
- Principia benchmark:配对物体关系测试暴露视频模型物理推理大缺口 — Varun Varma Thozhiyoor · 2026-09-04
- 开发者吐槽 AI 3D 管线仍靠手修:生成快了,清理 Blender 全手动 — TheJoyfulTater · 2026-09-04