开源 NaFlexCLAP:支持可变分辨率的音频-文本多模态模型

wightmanr · x · 2026-08-14

知名视觉模型研究者 Ross Wightman 分享了其最新的实验模型集合 NaFlexCLAP,目前已开源在 Hugging Face 上。

所属事件:OpenCLIP迎大更新,开源NaFlexCLAP多模态模型(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →