Iris-3B 开源:绕开 VAE 的像素空间扩散文生图模型,Apache 2.0 全开放
_akhaliq · x · 2026-10-09
Sperid Labs 发布 Iris-3B:一个从零预训练的 30 亿参数像素空间文生图模型,直接生成每一个像素、完全不使用 VAE 潜空间。论文还探索了其生成先验在细节敏感视觉任务上的表现,包括深度估计与图像修复。权重、代码与 demo 全部以 Apache 2.0 开放,已登 Hugging Face。
所属事件:Iris-3B开源像素空间文生图模型挑战VAE范式(3 条相关)→
「多模态」频道最新
- 实测:GPT-6 Luna 可识别 AI 生成图像,但仍有漏网 — Angaisb_ · 2026-10-09
- KAIST 提出 LongTake:长时程教师强制让长视频不再变成静态 — kaist-ai · 2026-10-09
- GPT-6 Image 2.5 复刻 1940 年代中国乡村新闻片质感 — DeryaTR_ · 2026-10-09
- Vigglorious Studio:分块+引导关键帧,让长视频角色一致性大幅提升 — Tablaski · 2026-10-09
- 星球大战 AI 神曲再出新作:Qui-Gon 的《Gin and Juice》 — aronchick · 2026-10-09
- MiniMax H3 生成僵尸短片走红,AI 视频再出爆款 — gabxav · 2026-10-09