Nature Medicine 研究:大模型能精准分诊,但存在校准缺陷

erichorvitz · x · 2026-08-04

Eric Horvitz 等人在 Nature Medicine 上发表的研究表明,在评估急诊分诊时,高推理能力的大模型表现出极高的区分度(AUROC 达 0.95-0.99),能准确识别哪些病例相对更危险。

然而,研究指出这些模型并不总是“校准”得很好。此前有研究发现 ChatGPT 曾在超过一半的紧急病例中出现分诊不足的情况,而本次分析表明,这并非因为模型完全无法识别紧急情况,而是其底层机制存在更微妙的偏差。

所属事件:研究揭示大模型医疗分诊精准但存在效用函数错位缺陷(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →