论文警告:可疑 Kaggle 医疗数据集已流入论文和临床
EhudReiter · x · 2026-07-22
Ehud Reiter 提到一篇论文,警告说一些可疑的 Kaggle 医疗数据集既被论文研究采用,也被用于真实临床实践。
作者强调的问题不只是 NLP 或 AI 里的“脏数据”,而是数据来源、质量与可追溯性:一旦对未经验证的数据集盲信,风险会直接进入医疗场景。
「研究」频道最新
- 一篇把 AI Agent 拆成 20 个组件的实战清单 — goyalshaliniuk · 2026-07-22
- Nature 提示整段基因编辑可行,AI 可能帮助重建其原理 — nathanbenaich · 2026-07-22
- ForeAgent 先预测再执行,让智能体收敛快 6 倍 — jiqizhixin · 2026-07-22
- 播客梳理 Kimi、Qwen、GLM 与中文实验室开源竞赛 — natolambert · 2026-07-22
- GPT-5.6 一次答对单侧检验的 FDR-BH 新结果 — lihua_lei_stat · 2026-07-22
- Training an Agent 第 2 课补充蒸馏资料、幻灯片和录屏 — SergioPaniego · 2026-07-22