SVD 压缩 AdaLN:MageFlow 4B 微调模型瘦身成 2.8B
Turbulent-Bass-649 · reddit · 2026-09-18
独立开发者更新其 MageTrail 项目:这是对微软 MageFlow 4B 文生图模型在 Danbooru/E621 风格数据上的全量微调(Proof of Concept),使用 41k 张多样性最大化的浓缩数据集,把 booru 标签式提示与插画能力注入模型,避免用完整 booru 数据集训练(可能花费 2-5 万美元以上)。
本次更新通过 rank 256 的 SVD 近似模型的 AdaLN 层,将架构从 4B 压缩到 2.8B(与 SDXL 同量级),生成速度略快、推理与训练显存大幅降低,质量损失很小。模型权重在 Hugging Face 和 Civitai 开放,配套开源训练器(bluvoll/mage-flow-trainer,支持 SDNQ)可供消费级 LoRA 微调,作者正基于 2.8B 架构用单张 H100 训练 V0.3。
「多模态」频道最新
- 博主预测:过半 AI 视频将由代码渲染生成,而非纯扩散模型 — _AustinCalvert_ · 2026-09-19
- 网友实测 GPT 图像模型:70s 科幻风格九宫格出图质感惊艳 — aziz4ai · 2026-09-19
- Codex 内置 Images 2.5:先用图像模型重设计页面再实现 — OpenAIDevs · 2026-09-19
- ComfyMax 音乐视频导演工作流:AI 生成 MV 制作进行中 — DanielVeres · 2026-09-19
- Jina AI 发布 jina-ocr-v1 文档理解模型,冲上 Hugging Face 热榜 — jinaai · 2026-09-19
- Reddit 求助:能否用 Agent 自动搭建 ComfyUI 视频工作流 — Hopeful-Election-783 · 2026-09-19