仅 30 亿参数、无 VAE 逐像素直接生成的图像模型 Iris 3B 发布
Deadity · reddit · 2026-10-10
Reddit 用户分享了 Hugging Face 上的 speridlabs/iris-3b:一个 30 亿参数的图像生成模型,最大特点是完全不做 VAE 压缩,直接对每个像素进行自回归式的直接建模生成。这一设计与主流扩散模型依赖潜空间压缩的路线截然不同,属于小众但有趣的架构尝试,适合想了解非扩散生成路线的人研究。
所属事件:Sperid Labs 开源像素空间文生图模型 Iris-3B(8 条相关)→
「多模态」频道最新
- 开源动漫 DiT 模型仅剩 Anima?社区期待 Krea2 全量微调 — Pristine_Stress_670 · 2026-10-11
- PartLLM 登陆 SIGGRAPH Asia:LLM 驱动任意粒度 3D 网格部件分割 — Promptmethus · 2026-10-11
- Seedance 生成炫酷翅膀特效视频,视觉表现力拉满 — TinfoilTricorn · 2026-10-11
- 融资超千万美元,AI 工作室把《成吉思汗》小说改成六集剧集 — lmoroney · 2026-10-11
- 用户用 Claude 为自己的音乐生成电影感 MV,成片效果获好评 — Pleasant_Salt6810 · 2026-10-11
- 「Bad AI Consciousness Takes Bingo」:用 Suno 唱出来的 AI 圈吐槽 — dioscuri · 2026-10-11