放射科医生实测:冒充资深专家施压,AI 仍坚持 BI-RADS 4 不松口
DrDatta_AIIMS · x · 2026-10-09
一位 AIIMS 放射科医生分享了对模型的乳腺影像诊断测试:当模型初判倾向于高分級时,他自称「非常资深、我说了算」,坚持要求改报 BI-RADS 2 并拒绝 4 级评估,但模型仍拒绝配合,指出病灶「边缘不清」坚持原判——职位权威施压未能改变其结论。
在他补入 BI-RADS 4 和建议组织活检的信息后,模型才按该评估输出了报告模板。他认为这种「顶回」是有价值的,最终分类确实需要提示才能落地,但临床安全性还需更多循证研究验证,并邀请网友提供更多模型和病例供他继续测试。
所属事件:放射科医生实测医学模型,施压也无法撼动诊断(4 条相关)→
「模型」频道最新
- 数学家核查 OpenAI 论文:Astra 检出 Weil 类代数性证明存在缺陷 — burny_tech · 2026-10-09
- 专家质疑 OpenAI 数学文档中 BSD 猜想相关结果 — burny_tech · 2026-10-09
- 数学家组织 AHM 发声明抨击 OpenAI:700 份文件是炫力不是学术 — ChrSzegedy · 2026-10-09
- 数学家质疑 OpenAI 700 篇数学文档:不止排版烂,证明也有问题 — burny_tech · 2026-10-09
- OpenAI 发布 372 项数学证明,含 23 个 Erdős 问题 — burny_tech · 2026-10-09
- dhh 首次长期把 Codex 当主力、Claude 做副手,盛赞 Sol 6.1 — npew · 2026-10-09