Nature Medicine 研究:大模型能精准分诊,但存在校准缺陷
erichorvitz · x · 2026-08-04
Eric Horvitz 等人在 Nature Medicine 上发表的研究表明,在评估急诊分诊时,高推理能力的大模型表现出极高的区分度(AUROC 达 0.95-0.99),能准确识别哪些病例相对更危险。
然而,研究指出这些模型并不总是“校准”得很好。此前有研究发现 ChatGPT 曾在超过一半的紧急病例中出现分诊不足的情况,而本次分析表明,这并非因为模型完全无法识别紧急情况,而是其底层机制存在更微妙的偏差。
所属事件:研究揭示大模型医疗分诊精准但存在效用函数错位缺陷(2 条相关)→
「研究」频道最新
- 仅凭输出文本即可逆向破解大模型隐藏 Prompt — mhmazur · 2026-08-05
- Biomni Lab 与日本中外制药合作,部署 AI 药物发现平台 — KexinHuang5 · 2026-08-05
- 提出「潜在阅读」:用单文本训练 AI 模型探索文学 — begusgasper · 2026-08-04
- 前沿对齐研究议程:如何根除奖励黑客与模型欺骗 — MariusHobbhahn · 2026-08-04
- 为什么让大模型直接改笔记总翻车?两篇论文揭示结构性缺陷 — Cryvixx · 2026-08-04
- 前沿 VLM 连拼图都拼不好?JigShape 基准直击视觉几何软肋 — _vztu · 2026-08-04