华科团队提出 Multimodal Flow:语言与视觉的全连续统一建模

hustvl · hf · 2026-10-02

华中科技大学团队(hustvl)发布 Multimodal Flow,一个语言与视觉完全连续的统一生成模型,代码与模型开源。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →