Nature 研究:GPT-4 可精准预测社会科学实验结果
RobbWiller · x · 2026-07-23
《Nature》最新发表论文指出,通过模拟参与者,GPT-4 能够高度精准地预测社会科学实验的结果。
- 实验规模:研究团队收集了 70 项预注册实验(包含 469 个效应量、119,330 名参与者),向 GPT-4 输入研究材料与人口统计学特征进行模拟。
- 核心发现:LLM 预测的效应量与实际观察到的效应量高度相关(r=0.85,调整后 r=0.92)。
- 防数据泄露验证:对于训练截止日期前未公开的研究(r=0.90)及截至 2025 年 6 月仍未发表的研究(r=0.92),预测相关性依然极高,排除了模型单纯“背诵”训练数据的可能。
- 人机对比:在更难的测试集上,GPT-4 的预测准确率(r=0.39)与 2,659 名人类专家的预测汇总(r=0.31)相当。由于两者能提供部分独立的信息,将人类预测与 GPT-4 预测平均结合,可将准确度提升至 r=0.89。
所属事件:Nature 研究:GPT-4 可高精度预测社会科学实验结果(15 条相关)→
「研究」频道最新
- OpenAI 联合 Apollo 研究:模型可能在讨好评分器 — rohanpaul_ai · 2026-07-23
- AI自主推翻数十年数学猜想,智能体奇点时刻正在降临 — imjustnewatai · 2026-07-23
- 应用数学主导AI浪潮,为何梯度下降依然有效? — fkasummer · 2026-07-23
- Cursor 的 Composer 2.5 推理明显弱于 Kimi 基座模型 — gleech · 2026-07-23
- Lanyon 称其神经符号求解器快前沿模型 20 到 250 倍 — burny_tech · 2026-07-23
- Kimi K3 配合 Tinker 跑出 19 组自动研究实验 — burny_tech · 2026-07-23