evalstats 项目揭示:小样本 AI 评估的置信区间方法大多不可靠

IanArawjo · x · 2026-09-04

研究者 Ian Arawjo 介绍 evalstats 项目:最初为搞清小样本 AI 评估该用哪种置信区间方法,结果发现 HCI(人机交互)研究对这些建议的需求最迫切——该领域普遍在小样本下工作。项目正在补充一项针对 between-subjects 数据成对置信区间推荐的研究。

所属事件:研究称小样本 AI 评估置信区间方法普遍不可靠(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →