仅 5000 欧训练出 <300M 参数图像模型,号称同级 SoTA 达 SD1.5 水平

incorporo · reddit · 2026-09-29

Logolabs 团队在 Reddit 发布 Agate-003-preview:一个参数量不足 300M(含文本编码器与 VAE)的图像生成模型,宣称以少 3 倍的参数达到 SD 1.5 级别的性能,且训练全流程(含 R&D)成本仅约 5000 欧元、630 个 GH-200 GPU 小时,其中主体训练仅 319 GPU 小时。

关键技术路线:

版本演进:Agate-001 → 002(256×256) → 003(原生 512×512,通过学习式上/下采样器保持规划分辨率不变)。模型支持 LoRA 微调,小体量下训练门槛很低;团队计划将其用于 Logolabs 的字体/符号生成。资源:HF 模型页、WebGPU 在线体验(含 thinker preview)、ComfyUI 节点均已开放。

所属事件:Logolabs 发布超小型文生图模型 Agate,260M 参数比肩 SD1.5(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →