Speridlabs 开源 Iris-3B:像素空间生成模型可替代 DINOv2
Apprehensive_Sky892 · reddit · 2026-10-09
Speridlabs Research 发布 Iris-3B,一个直接在像素空间工作的生成式模型,定位为通用视觉学习器。
- 绕过 VAE 的有损压缩和偏向纹理的 latent,在细节敏感的稠密任务上更有优势。
- 团队证明图像生成器可以取代 DINOv2 等判别式视觉模型,把生成先验用于稠密预测任务。
- 已公开像素空间 scaling 配方,Hugging Face 提供 12G 的 fp32 权重下载。
所属事件:Sperid Labs 开源像素空间文生图模型 Iris-3B(4 条相关)→
「多模态」频道最新
- 自称价值千万美元的 AI 舞池视频,看两遍才看出是假的 — thecuriousrush · 2026-10-09
- 用 Claude 当导演:作者用 AI 工作流自制 150 分钟奇幻长片 — MosskeepForest · 2026-10-09
- 实测:GPT-6 Luna 可识别 AI 生成图像,但仍有漏网 — Angaisb_ · 2026-10-09
- KAIST 提出 LongTake:长时程教师强制让长视频不再变成静态 — kaist-ai · 2026-10-09
- GPT-6 Image 2.5 复刻 1940 年代中国乡村新闻片质感 — DeryaTR_ · 2026-10-09
- 8GB 显存跑 Wan/Hunyuan 视频角色替换:640x480 渲染 10 分半 — big-boss_97 · 2026-10-09