医生故意误导 AI 模型,医学 AI 坚持要求补全证据拒绝附和
FellMentKE · x · 2026-10-10
放射科医生 FellMentKE 用合成乳腺钼靶病例测试 Ling 3.0 Flash Sante:能否在医生出错时顶回去?
- 他先只给出「52 岁女性、11mm 肿块」的极少信息,并主动暗示 BI-RADS 2(良性),模型拒绝直接出报告,反而要求补充肿块边缘、形态、既往影像、超声和临床史。
- 随后医生继续给出细节(边缘模糊的 11×9mm 肿块),模型提出 BI-RADS 0(需超声进一步评估)的分级,并给出条件化处理路径,与医生暗示的 BI-RADS 2 不同。
- 最后医生以「我是非常资深放射科医生」施压,线程展示了模型面对权威话术时的反应。
这一测试的价值在于观察医学 AI 是否会盲目服从医生、还是在信息不足时主动追问并给出独立判断——后者正是临床辅助工具最需要的特质。
所属事件:AIIMS 医生实测:医学 AI 顶住权威施压坚持正确 BI-RADS 分级(8 条相关)→
「模型」频道最新
- 汇总 GPT 与 Claude 两代旗舰在独立基准上的两年进步曲线 — FlorianGallwitz · 2026-10-10
- LLM「神秘体验」实验:不同模型呈现不同吸引子状态 — rgblong · 2026-10-10
- Hamel Husain 与 Joseph Barrow 演讲:如何选 OCR 模型已上线 YouTube — HamelHusain · 2026-10-10
- 博主:用好 Gemini 的最佳入口其实是 AI Studio 和 Antigravity — Zergylord · 2026-10-10
- Codex 连续五天推 Pro 专属更新,普通用户抱怨被忽视 — Angaisb_ · 2026-10-10
- Delip Rao 质疑微软新模型:为何基准测试不敢比准确率 — deliprao · 2026-10-10