Iris-3B 开源:不用 VAE 的像素空间文生图模型,3B 参数 Apache 2.0
zhenjun_zhao · x · 2026-10-09
Sperid Labs 发布 Iris-3B:一个直接在像素空间生成每个像素的文生图模型与通用视觉学习器,无需 VAE。模型从零开始预训练,参数量 3B,权重开放(Apache 2.0)。
团队还探索了其生成先验在对细节敏感的视觉任务上的应用,包括深度估计和图像修复。代码、权重与 demo 全部开源。
所属事件:Sperid Labs 开源 Iris-3B:像素空间文生图实证不优于潜在空间(2 条相关)→
「多模态」频道最新
- 1B 参数 OCR 模型单日刷 49 万页,千页成本不到 1 美分 — IgorCarron · 2026-10-09
- 数千张 AI 生成图找不到原参数?开源本地图库正设计按设置反查 — shivam_dewan · 2026-10-09
- 开源创意工作 harness Voyager 发布:让 Claude、Codex 更懂创作 — testingcatalog · 2026-10-09
- Voyager 发布:用 Opus 等模型驱动 AE、Blender 等创意工具的「创意版 Codex」 — HeyAmit_ · 2026-10-09
- YuE2 LoRA 训练新曲风屡试屡败,求助社区经验 — EuphoricTrainer311 · 2026-10-09
- 泰国满街 AI 菜单图惨不忍睹,网友归咎 ChatGPT 出图 — sirebral · 2026-10-09