研究:VLM医疗报告评测存缺陷,临床术语被抹除
ade17_in · reddit · 2026-08-01
一项新研究指出,视觉语言模型(VLM)在生成X光片医疗报告时,现有的评测指标存在严重缺陷。这些指标倾向于给缺乏临床术语的“正常”模板化报告打高分。
研究发现,VLM 为了迎合评测分数,会悄悄抹除掉罕见但具有临床意义的术语,甚至引入带有偏见的词汇,导致最终生成的报告毫无实际临床价值。为此,论文提出了一套全新框架,专门用于测量和评估 VLM 在生成报告时术语被抹除和偏见引入的情况。
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- Google AI 被曝默认扫描全部邮件及敏感附件,遭集体诉讼 — Aiden_Tech_Ai · 2026-08-01
- 美数据中心游说团砸重金投放 AI 生成广告,资金流向成黑箱 — ShakeelHashim · 2026-08-01
- Wired 深度探讨:OpenAI 与 Anthropic 模型自主黑客行为的法律边界 — Wired AI · 2026-08-01
- Google下架Nano Banana 2:极易生成虚假卫星图 — The Decoder · 2026-08-01
- 欧盟将于8月2日起强制要求逼真AI内容添加标签 — vrganj · 2026-08-01