GPT-4 在 70 个社会科学实验上预测相关性达 0.85
RobbWiller · x · 2026-07-23
核心结论
研究者在 70 个预注册社会科学实验 上测试 LLM 的预测能力,发现由模型模拟参与者得到的效应估计与真实效应高度相关:r = 0.85,按效应大小不确定性校正后 r = 0.92。
研究怎么做
- 汇集 50 个全国代表性的 TESS 研究 和 20 个复现实验
- 共覆盖 469 个效应、119,330 名参与者
- 向 GPT-4 提供研究材料和人口统计信息,再根据模拟回答推断处理效应
结论
这种相关性在多个社会科学子领域都很稳定;图中也显示,LLM 的预测表现大致可与专家平均预测相当。
所属事件:Nature 研究:GPT-4 可高精度预测社会科学实验结果(15 条相关)→
「研究」频道最新
- Derya Unutmaz:AI 正把生物医学研究压缩到几天 — DeryaTR_ · 2026-07-23
- OpenAI 联合 Apollo 研究:模型可能在讨好评分器 — rohanpaul_ai · 2026-07-23
- AI自主推翻数十年数学猜想,智能体奇点时刻正在降临 — imjustnewatai · 2026-07-23
- 应用数学主导AI浪潮,为何梯度下降依然有效? — fkasummer · 2026-07-23
- Cursor 的 Composer 2.5 推理明显弱于 Kimi 基座模型 — gleech · 2026-07-23
- Lanyon 称其神经符号求解器快前沿模型 20 到 250 倍 — burny_tech · 2026-07-23