用 4B 小模型替换 32B:MiniMax H3 视频生成的极限压缩实测

Fit_Ad7343 · reddit · 2026-08-09

作者分享了一种将 MiniMax H3 视频生成模型中原有的 Qwen3-VL-32B 文本编码器替换为 Qwen3-VL-4B 的技术方案。通过学习一个线性投影矩阵(岭回归),将 4B 模型的隐藏状态映射到 32B 的条件空间,成功将显存占用从 15.7GB 降至 4.5GB。

技术细节与效果:

局限性:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →