SoL-Refiner:一步去噪将低清视频精修至 4K,提速 8.91 倍
Haozhe Liu · hf · 2026-09-30
高分辨率视频生成成本随时空 token 数快速膨胀。SoL-Refiner 提出一步视频精修器,把低分辨率模型输出一步去噪转为 4K 视频。
方法与结果:
- 三阶段配方:高分辨率持续训练 + RL 后训练 + 最后一步蒸馏
- 构建 Refiner-Bench 精修基准,采用共享输入协议在约 2K 分辨率下对比
- 2K 下超过所有外部精修器的 VBench 与 UniPercept 均值;3840×2176 下也优于三步的 LTX-2.3 Refiner
- 完整加速栈下,精修延迟较同基线提速 8.91 倍
「多模态」频道最新
- Midjourney 虚构 token 示例补图:ALTS 效果对照 — LudovicCreator · 2026-09-30
- Midjourney v8.2 新玩法:4 个虚构 token 玩出记忆残影与骨骼回声 — LudovicCreator · 2026-09-30
- 开发者直言超个性化音乐是伪命题:音乐本质是社交文化 — jordiponsdotme · 2026-09-30
- 新加坡国立大学发布 StoryEngine:状态锚定的长篇视频叙事智能体框架 — NationalUniversityofSingapore · 2026-09-30
- 本地生图一年:从 Civitai 到 ComfyUI,体验为何都烂 — BenDLH · 2026-09-30
- 用 Opus 50 分钟做出 Violetto 1B 宣传片,几乎零媒体关注 — tensorqt · 2026-09-30