开源医疗大模型评测数据集索引库发布
BraydonDymm · x · 2026-08-13
开发者构建了 Open Medical LLM Datasets 项目,旨在为医疗 AI 领域提供一个系统性的开放数据集目录。
该项目将各类可用于评估生成式 AI 的基准数据集按评估能力进行了分类,包括:医学知识、临床推理、安全性、文档生成、多模态推理、智能体工作流以及健康公平性等。
此外,每个数据集条目都标注了其对应的能力是主要评估目标还是次要目标,方便研究者根据实际测试需求精准选择合适的 benchmark。
「研究」频道最新
- 前 OpenAI 研究员:AI 进步更多源于模型提升而非人工标注 — RyanGreenblatt · 2026-08-13
- 前 OpenAI 研究员:人类标注数据并非 AI 进步的核心瓶颈 — RyanGreenblatt · 2026-08-13
- Ilya 新动向:TTT 测试时训练将开启模型持续学习 — iruletheworldmo · 2026-08-13
- 华为诺亚方舟实验室推 RoboHarness:免重训编排异构机器人策略 — jiqizhixin · 2026-08-13
- 去中心化 AI 药物发现竞赛奖金升至 14.4 万美元 — richdotca · 2026-08-13
- VIScore:诊断潜在世界模型规划质量的新指标 — DrMorganLevine · 2026-08-13