蚂蚁集团推 MedGuard:拦截 AI 诊疗中的医疗事实错误
jiqizhixin · x · 2026-08-29
蚂蚁集团与厦门大学在 npj Digital Medicine (IF 18.0) 发表了 MedGuard。这并非另一个 AI 咨询系统,而是一个嵌入临床工作流的安全基础设施层。基于 7B LLM 构建,它在医生诊断、AI 响应和用药计划最终确定前进行拦截,提取陈述性声明,并对照临床指南和证据链验证关键医疗主张,标记可能漏掉的风险。
成果:在细粒度对话级风险检测上达到 SOTA,F1 分数比基线提高 22.1%,声明提取提高 23.2%。在 41 个医疗子类别中,平均 F1 达到 0.7。
「安全」频道最新
- CSIS 专家组探讨 AI 包容失效后的政府对策 — hlntnr · 2026-08-29
- MiniMax H3 条款引争议:美欧等地或禁发视频 — donkeykong917 · 2026-08-29
- 预测市场:年底前 68% 概率有州颁布数据中心禁令 — Polymarket · 2026-08-29
- 针对生物安全风险应采取类似 BSL-4 级别的预防措施 — JoshPurtell · 2026-08-29
- X 平台为 LLM 生成推文新增“Made with AI”标签 — deliprao · 2026-08-29
- OpenAI 与 METR 克服内部阻力发布关键安全报告 — morqon · 2026-08-29