同团队再强调:更大模型与更强推理都修不好医疗事实核查

mdredze · x · 2026-10-09

Mark Dredze 在其 NeurIPS GenAI4Health Oral 论文基础上补充核心结论:医疗领域的「检索后验证」事实核查以系统性的方式失败——而更大的模型、更多推理算力、更好的信息来源和医疗领域微调,都无法修复这些问题。

这是对同一条研究线的浓缩表述,与该组入选 Oral 的失败分类研究相互呼应。

所属事件:研究称医疗AI事实核查系统性失败,大模型与微调均无解(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →