GPT-4 在 70 个社会科学实验上预测相关性达 0.85
RobbWiller · x · 2026-07-23
核心结论
研究者在 70 个预注册社会科学实验 上测试 LLM 的预测能力,发现由模型模拟参与者得到的效应估计与真实效应高度相关:r = 0.85,按效应大小不确定性校正后 r = 0.92。
研究怎么做
- 汇集 50 个全国代表性的 TESS 研究 和 20 个复现实验
- 共覆盖 469 个效应、119,330 名参与者
- 向 GPT-4 提供研究材料和人口统计信息,再根据模拟回答推断处理效应
结论
这种相关性在多个社会科学子领域都很稳定;图中也显示,LLM 的预测表现大致可与专家平均预测相当。
所属事件:Nature 研究:GPT-4 可高准确度预测社科实验结果(18 条相关)→
「研究」频道最新
- HF 工程师争论:非生成任务全用因果注意力是在浪费算力 — antoine_chaffin · 2026-09-11
- 智利学者:AI 反馈规模化是医学教育可持续的关键 — julianvarascom · 2026-09-11
- Nature 新研究实现全身器官细胞活动成像,揭示跨器官体级回路 — arjunrajlab · 2026-09-11
- SignNet 1M 手语数据集发布 — ducha_aiki · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- InFlux++ 方法发布 — ducha_aiki · 2026-09-11