MODUS 用单个解码器模型统一任意模态互预测

EPFL-VILAB · hf · 2026-07-29

MODUS 提出了一种统一的 decoder-only any-to-any 多模态建模框架:同一个模型可以在任意模态组合之间做预测,把“任意模态作为输入、任意模态作为输出”这件事统一起来。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →