患者沟通致 LLM 诊断准确率骤降 60%
wandedob · x · 2026-08-23
一项随机对照研究显示,当患者而非医生作为沟通者向 LLM 描述病情时,模型的诊断准确率下降了 60%,适当管理决策的准确率下降了 12%。
研究结论揭示了以下问题:
- LLM 具有易受暗示、天真和谄媚(sycophantic)的特性。
- 输出质量高度依赖输入者的医疗素养,素养越低,输出越不准。
- 即使是前沿模型,其医疗准确性仍受提示词困扰。
这表明,如果用户无法识别 LLM 的偏见和错误,直接信任其医疗建议是不安全的。
「安全」频道最新
- 观点:数据中心禁令是公众对失控未来的无力反击 — edelwax · 2026-08-23
- 阿里利用无声波纹劫持音频管道追踪设备 — SumitGup · 2026-08-23
- Decels 监管寻忆致产业外迁?2050 设想引发争议 — beffjezos · 2026-08-23
- 高危工具需双重确认:agent 权限治理速查表 — blaizedsouza · 2026-08-23
- 回顾 Alondra Nelson 三年前提出的“Thick Alignment”理念 — arvindsatya1 · 2026-08-23
- 如何真正验证 AI 公司的隐私承诺?业界缺乏验证机制 — Sea_Supermarket_8755 · 2026-08-23