商汤发布 SenseNova-U1.5:8B 无编码器统一模型实现理解生成一体

KyeGomezB · x · 2026-09-14

商汤团队发布 SenseNova-U1.5,一个 8B-MoT 原生统一多模态模型,采用 encoder-free、VAE-free 架构,在像素空间直接完成图像理解、推理、生成与编辑,支持原生 4K 分辨率生成。

关键做法:

论文以此论证视觉理解与生成可以共享同一原生表征,而非分离的两套系统。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →