Iris-3B 开源:绕开 VAE 的像素空间扩散文生图模型,Apache 2.0 全开放

_akhaliq · x · 2026-10-09

Sperid Labs 发布 Iris-3B:一个从零预训练的 30 亿参数像素空间文生图模型,直接生成每一个像素、完全不使用 VAE 潜空间。论文还探索了其生成先验在细节敏感视觉任务上的表现,包括深度估计与图像修复。权重、代码与 demo 全部以 Apache 2.0 开放,已登 Hugging Face。

所属事件:Iris-3B开源像素空间文生图模型挑战VAE范式(3 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →