15个前沿LLM医疗测试:对抗压力下94%正确答案失效
davidmanheim · x · 2026-09-06
作者在讨论一项针对15个前沿大模型的医疗可靠性研究,并追问:医生本身就面临药厂销售、保险规则等多种对抗性压力导致诊疗质量下降,AI 反而不受这些压力影响——这些人类对抗性风险是否比 AI 自身的对抗风险更严重?研究背景是:模型在 MedQA 等静态考试上准确率超 80%,但在自适应对抗压力下中位数 94% 的正确答案失效。
所属事件:前沿LLM医疗可靠性引热议:对抗压力与不作为伦理成焦点(2 条相关)→
「安全」频道最新
- 网友调侃:生物恐怖与网络安全已被当成显然的迫近威胁 — EigenGender · 2026-09-06
- 曝 GPT-6 被扩展型 Task-In-Prompt 攻击越狱,安全细节待证实 — EducationalCicada · 2026-09-06
- xAI 诉明尼苏达州 AI「脱衣」禁令案:临时禁令申请被驳回 — VraserX · 2026-09-06
- 谷歌常驻Agent Gemini Spark 可管照片行程,隐私问题引关注 — emmanuelvivier · 2026-09-06
- 洛杉矶学区新政策:学校禁用生成式 AI 一整年 — emmanuelvivier · 2026-09-06
- OpenAI Daybreak 扩展至水电设施,助其防御网络攻击 — emmanuelvivier · 2026-09-06