SenseNova-Vision:将视觉任务重构为统一多模态生成

rsasaki0109 · x · 2026-08-31

SenseNova-Vision 提出将计算机视觉表述为统一的多模态生成任务。通过统一多模态模型(UMM)的原生文本和图像生成空间来表达异构视觉任务。

核心机制:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →