仅 30 亿参数、无 VAE 逐像素直接生成的图像模型 Iris 3B 发布

Deadity · reddit · 2026-10-10

Reddit 用户分享了 Hugging Face 上的 speridlabs/iris-3b:一个 30 亿参数的图像生成模型,最大特点是完全不做 VAE 压缩,直接对每个像素进行自回归式的直接建模生成。这一设计与主流扩散模型依赖潜空间压缩的路线截然不同,属于小众但有趣的架构尝试,适合想了解非扩散生成路线的人研究。

所属事件:Sperid Labs 开源像素空间文生图模型 Iris-3B(8 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →