一份综述发现不少医学影像论文仍在错误切分数据
wandedob · x · 2026-07-27
这条帖子说明了一份医学影像研究报告的检查标准:论文到底是按患者/整卷/整张切片划分训练、验证和测试集,还是错误地按2D 切片/patch/单张图像划分。后者会造成数据泄漏,让指标虚高。
报告覆盖两类工作:
- 把 MRI、CT、OCT、超声等 3D 医学影像拆成 2D 切片,再用 2D CNN 或 2D ViT 做分类/分割
- 把数字病理的 whole-slide image (WSI) 切成 2D patch,再训练 CNN/ViT
后续统计里提到,纳入的 59 篇论文中有 26 篇做法正确、13 篇明确错误、20 篇不清楚;另外还有一些论文因时间窗口或付费墙原因未能完全核实。
所属事件:AI审计发现部分医学影像论文存在数据泄漏(4 条相关)→
「研究」频道最新
- 开源基准工具可安全统计 coding agent token 消耗 — bestofdesp · 2026-07-28
- 研究者回应审稿:观察性数据也能做因果推断 — yanaiela · 2026-07-28
- 更强模型也可能拖垮产品,先做生产任务测试 — max_gladysh · 2026-07-28
- RepLLM 用四个智能体把网络论文复现压到两小时内 — 机器之心 · 2026-07-28
- Vision-OPD 用 6.2K 合成样本提升细粒度视觉理解 — 小红书技术REDtech · 2026-07-28
- 论文称冻结 12B 模型可零 token 重跑已验证程序 — MindPsychological140 · 2026-07-28