放射科医生实测医学模型,施压也无法撼动诊断
AIIMS 放射科医生 DrDatta 开始系统评测各家 AI 模型,首个对象是 OpenRouter 上的医学模型 Ling 3.0 Flash Sante。面对仅「52 岁女性 + 11mm 肿块」的极少信息并暗示报 BI-RADS 2,模型拒绝直接出报告;当医生自称「非常资深的放射科医生」并施压要求改报 BI-RADS 2、拒绝 4 级时,模型依然坚持其 BI-RADS 4(边缘模糊)的判断,展现出不迎合权威的稳健性。
2026-10-09 ~ 2026-10-09 · 4 条相关
- 放射科医生实测:医学模型 Ling 3.0 敢顶撞权威坚持 BI-RADS 4 — DrDatta_AIIMS · 2026-10-09
- 放射科医生实测:冒充资深专家施压,AI 仍坚持 BI-RADS 4 不松口 — DrDatta_AIIMS · 2026-10-09
- 医学模型拒绝给信息不足的 52 岁患者直接出报告 — DrDatta_AIIMS · 2026-10-09
- 「我是资深放射科医生」施压无效,模型坚持指向边缘模糊 — DrDatta_AIIMS · 2026-10-09