开源医疗大模型评测数据集索引库发布

BraydonDymm · x · 2026-08-13

开发者构建了 Open Medical LLM Datasets 项目,旨在为医疗 AI 领域提供一个系统性的开放数据集目录。

该项目将各类可用于评估生成式 AI 的基准数据集按评估能力进行了分类,包括:医学知识、临床推理、安全性、文档生成、多模态推理、智能体工作流以及健康公平性等。

此外,每个数据集条目都标注了其对应的能力是主要评估目标还是次要目标,方便研究者根据实际测试需求精准选择合适的 benchmark。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →