FuseReg 论文:正则化层融合弥合表示自编码器重建-生成鸿沟
_akhaliq · x · 2026-09-29
- Representation Autoencoder(RAE)将多个 encoder 层特征融合进共享隐空间,但重建与生成对层级偏好不同:decoder 偏好浅层、像素丰富的特征,而 DiT 偏好更深层、结构化的语义特征,导致重建-生成失配。
- FuseReg 不搜索单一最优融合层,而是训练模型在层融合的分布上保持鲁棒,从而缓解这一鸿沟。
- 论文页面已发布在 Hugging Face(akhaliq 转发)。
所属事件:FuseReg 正则化弥合自编码器重建与生成鸿沟(2 条相关)→
「多模态」频道最新
- 物理模拟全乐器演奏:LLM 驾驭萨克斯泛音列完成通排 — alexanderchen · 2026-09-29
- AI 视频新思路:导入电影镜头,只替换世界不动运镜 — LearnWithBishal · 2026-09-29
- 用 Magnific + Seedance 2.5 生成「反派老板」视频,附 prompt — charis_ai · 2026-09-29
- 求助:本地换脸工具全线失灵,老玩家重装后 IP Adapter 也不工作 — DwemerNose · 2026-09-29
- PrunaAI 双版本 P-Video-2 Pro 以 Elo 1325 并列图生视频榜第2 — guennemann · 2026-09-29
- QuiverAI Arrow 2 Telos 以 1624 Elo 首破 SVG 生成排行榜 1600 分 — stuffyokodraws · 2026-09-29