外科智能榜单更新:20余款通用 VLM 全面落后专科模型

ddonoho · x · 2026-09-15

SDSC × UChicago 团队更新了「外科智能排行榜」,在 10 个手术相关数据集上对比当前主流视觉语言模型,覆盖器械识别、解剖结构、手术技能评估、上下文 VQA 和操作建议五类任务。

核心发现:

结论:外科视频理解这类专科任务上,通用 VLM 与领域专科模型之间仍有巨大差距。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →