GPT-4 对未发表社会科学研究仍保持高相关性
RobbWiller · x · 2026-07-23
模型对比
这条补充显示,GPT-4 的预测并不只是“记住了已发表结果”。即便实验在训练截止前未公开、甚至到 2025 年 6 月 仍未发表,相关性依然很高。
稳健性
- 图中 GPT-4 的相关性大致在 0.92 左右
- 多个社会科学子领域都保持了较高一致性
- 开源权重模型也表现不错,图里大约在 0.81–0.86 区间
结论
作者想证明:这类结果不太像纯粹的“训练集泄漏”,而是模型确实学到了一些可迁移的预测模式。
所属事件:Nature 研究:GPT-4 可高精度预测社会科学实验结果(15 条相关)→
「研究」频道最新
- AI自主推翻数十年数学猜想,智能体奇点时刻正在降临 — imjustnewatai · 2026-07-23
- 应用数学主导AI浪潮,为何梯度下降依然有效? — fkasummer · 2026-07-23
- Cursor 的 Composer 2.5 推理明显弱于 Kimi 基座模型 — gleech · 2026-07-23
- Lanyon 称其神经符号求解器快前沿模型 20 到 250 倍 — burny_tech · 2026-07-23
- Kimi K3 配合 Tinker 跑出 19 组自动研究实验 — burny_tech · 2026-07-23
- GPT-5.6 Pro 一条提示词后给出数学猜想证明 — scaling01 · 2026-07-23