Iris-3B 开源:像素空间生成与通用视觉学习模型发布
Total-Resort-3120 · reddit · 2026-10-09
Reddit 用户分享了一个新开源项目 Iris-3B,定位为像素空间生成(pixel-space generation)与通用视觉学习模型,支持在像素级直接进行图像生成与视觉任务学习。
- 模型权重已上架 Hugging Face(speridlabs/iris-3b)
- 代码与项目细节开源于 GitHub(speridlabs/iris-3b)
- 3B 参数规模,主打不依赖潜空间、直接在像素域完成生成与视觉理解
所属事件:Sperid Labs 开源像素空间文生图模型 Iris-3B(5 条相关)→
「多模态」频道最新
- 腾讯混元开源 MC-Sparse:免训练稀疏注意力,视频去噪提速 1.8 倍 — Tencent-Hunyuan · 2026-10-09
- 腾讯 OmniCapBench:786 条视频细粒度评测音视频字幕,暴露长程推理短板 — Tencent-Hunyuan · 2026-10-09
- 自由设定镜头路径:生成场景里的运镜体验火了 — XRarchitect · 2026-10-09
- Seedance 2.5 实测视频细节惊人,网友直呼离谱 — SimplyAnnisa · 2026-10-09
- Claude Motion 发布即打通 HyperFrames Studio,可加音乐音效 — sean_t_strong · 2026-10-09
- RTX 3060 12GB 本地跑通 AI 音乐视频,创作完成 — netrang · 2026-10-09