研究揭示大模型医疗分诊精准但存在效用函数错位缺陷

Eric Horvitz 等人在 Nature Medicine 上发表的研究指出,高推理能力的大模型在急诊分诊评估中表现出极高的区分度(AUROC 达 0.95-0.99)。然而,大模型在医疗分诊中给出糟糕建议的根本原因并非缺乏医学知识,而是其隐式对齐的效用函数出了问题。研究引入了决策分析框架,证实模型其实非常清楚病情的严重程度,仅是效用函数错位导致了最终失误。

2026-08-04 ~ 2026-08-04 · 2 条相关