开源视觉模型SenseNova-Vision

FellMentKE · x · 2026-07-17

SenseNova-Vision 被描述为一个 7B 开源视觉基础模型,用自然语言提示即可完成检测、分割、深度估计和多视角几何等任务。

帖子强调它把视觉能力做成统一的 foundation model,而不是拆成多个专用模型;同时给出权重、代码、5000 万样本数据集和论文,并声称在多项任务上优于专用系统(如 Vision Banana)。

所属事件:商汤开源统一视觉大模型 SenseNova-Vision(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →