Nature 研究:GPT-4 可精准预测社会科学实验结果
RobbWiller · x · 2026-07-23
《Nature》最新发表论文指出,通过模拟参与者,GPT-4 能够高度精准地预测社会科学实验的结果。
- 实验规模:研究团队收集了 70 项预注册实验(包含 469 个效应量、119,330 名参与者),向 GPT-4 输入研究材料与人口统计学特征进行模拟。
- 核心发现:LLM 预测的效应量与实际观察到的效应量高度相关(r=0.85,调整后 r=0.92)。
- 防数据泄露验证:对于训练截止日期前未公开的研究(r=0.90)及截至 2025 年 6 月仍未发表的研究(r=0.92),预测相关性依然极高,排除了模型单纯“背诵”训练数据的可能。
- 人机对比:在更难的测试集上,GPT-4 的预测准确率(r=0.39)与 2,659 名人类专家的预测汇总(r=0.31)相当。由于两者能提供部分独立的信息,将人类预测与 GPT-4 预测平均结合,可将准确度提升至 r=0.89。
所属事件:Nature 研究:GPT-4 可高准确度预测社科实验结果(18 条相关)→
「研究」频道最新
- Chelsea Finn:机器人 RL 的瓶颈是物理 rollout 成本 — ycombinator · 2026-07-27
- ICML 2026 口头论文复现分数重算后仍偏中等 — profjamesevans · 2026-07-27
- 长周期智能体最终需要不可变事件日志 — sebpaquet · 2026-07-27
- Seed IQ 在 Doom II 里通关,引出 ARC-AGI 之后的评测问题 — Fit_Transition8824 · 2026-07-27
- 实测智能体数据科学工作流:代码能跑但常答错问题 — hugobowne · 2026-07-27
- 一份横跨 ML、系统、NLP 与音频的经典论文清单 — deliprao · 2026-07-27