SenseNova-Vision-7B-MoT开源
joemeno · x · 2026-07-15
SenseTime 转发介绍 SenseNova-Vision-7B-MoT:一个完全开源的视觉模型,主打把多种视觉任务统一到一个模型里处理。支持的能力包括:
- 检测、OCR、GUI 理解
- 深度/法线估计
- 分割
- 多视角任务
帖子还提到它可以通过自然语言定义新的视觉任务变体,跨传统视觉边界重组能力。开源内容包括:模型权重、SenseNova-Vision Corpus(50M 样本子集)以及复现剩余公共数据所需的完整工具链。原帖附有 Hugging Face、GitHub、在线 Demo 和技术报告链接。