NVIDIA 发 PixelUMM:免编码器统一图像视频理解与生成

nvidia · hf · 2026-10-02

NVIDIA 发布 PixelUMM,一个免编码器(encoder-free)的统一多模态模型,直接在像素空间同时完成图像与视频的理解和生成。

所属事件:NVIDIA 发布免编码器统一多模态模型 PixelUMM(3 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →