BRIE 基准发布:首次系统评估 LLM 从长程电子病历中检索信息的能力
BraydonDymm · x · 2026-10-06
随着临床医生越来越多地用 LLM 从长程电子病历(longitudinal EHR)中提取信息,业内一直缺乏可规模化、随时间演进评估模型的方法。Emily Alsentzer 团队发布预印本 BRIE——一个用于「从电子病历检索信息」的动态(living)基准,由 rising star Cahoon 主导。
该基准旨在回答:当 LLM 不断被集成进医疗系统、且模型持续迭代时,如何高效评估它们能否可靠检索到临床所需信息。这是将 LLM 评测引入医疗信息检索场景的新尝试。
所属事件:BRIE 活基准发布,系统评估 LLM 从长程病历检索信息能力(2 条相关)→
「研究」频道最新
- 研究者警告:User Sim Index 评测可被轻松刷到 95% — ericzelikman · 2026-10-06
- 用OpenAI Dots智能体集群免费打破47年数学纪录 — jaxchang · 2026-10-06
- 斯坦福教授批虚拟细胞研究:现有实验设计撑不起因果模型 — anshulkundaje · 2026-10-06
- COLM 2026 将发布 TIDES 多方对话与多智能体协作数据集 — josephseering · 2026-10-06
- LakeQuest 论文明日亮相 COLM,专测表格文档混排的复杂 QA — hllo_wrld · 2026-10-06
- Snorkel 前沿数据峰会日程曝光:Chollet 领衔,十余个新 Agent 基准集中亮相 — StanfordAILab · 2026-10-06