260M 参数开源生图模型 Agate 性能逼近 SD 1.5,附 ComfyUI 节点
incorporo · reddit · 2026-09-26
Logolabs 发布 Agate-001-preview,仅 260M 参数(含文本编码器)的开源生图模型,MIT 协议开放权重,性能接近参数量 3 倍的 SD 1.5,在同尺寸下超越 DiT 与 FDCM,达到 Pareto 前沿。
架构亮点:
- Thinker-renderer 混合架构:小型循环 transformer(thinker)读取 prompt 并规划 16×16 区域图,负责整体规划与画布理解;卷积型 FDCM renderer 负责把 latent 思考 token 转成图像,各取所长。
- 文本编码器基于 Etnin-68M,先冻结 10 epoch 再联合训练,损失下降显著。
- 训练数据为 Flux-Reason-6M,约 26 epoch 未收敛,后续持续训练仍有提升空间。
限制与用途:目前仅支持 256×256、使用 SD 1.5 VAE;适合廉价合成数据生成、专有数据集小模型训练、缩略图生成、移动端生图等场景。已在 Hugging Face 开放权重,提供浏览器 WebGPU Demo 与 ComfyUI 节点。
所属事件:260M 参数开源生图模型 Agate-001 性能逼近 SD 1.5(2 条相关)→
「多模态」频道最新
- 20 分钟花 40 美元,Opus 5.5 写代码做出完整创业公司宣传片 — cedric_chee · 2026-09-26
- 单条 Prompt 生成专业级 Motion Graphics,网友实测「动效已被解决」 — claud_fuen · 2026-09-26
- Google Vids 开放免费 AI 视频生成,普通账号即可产 1080p 视频 — alexcovo_eth · 2026-09-26
- Opus 5.5 二十分钟纯代码产出动画配乐配音的启动视频 — cedric_chee · 2026-09-26
- 空歌词喂给音乐模型 YuE 2,竟唱出一堆听不懂的歌词 — SteveLittleFish · 2026-09-26
- 网传「Opus 5.5」出人意料,用户称生成视频几乎零成本零努力 — chaumian · 2026-09-26