LLM 预测平均高估 2 倍,现场实验上更弱
RobbWiller · x · 2026-07-23
这条强调了 LLM 预测的主要局限性。
- 平均来看,LLM 的预测结果 大约高出 2 倍。
- 在 小效应、稳定的既有态度、现场实验 和 非文本处理 上,准确率更低。
- 作者的结论是:LLM 可以帮助研究决策,但不能替代人类证据,尤其是在更难预测的场景里。
所属事件:《Nature》称大模型可低成本预测社会科学实验(14 条相关)→
「研究」频道最新
- Science 论文把忆阻器漂移变成 2.12 毫秒神经动力系统 — jiqizhixin · 2026-07-23
- W&B 说世界动作模型会先“做梦”再决定动作 — wandb · 2026-07-23
- W&B 评测显示,NVIDIA 14B DreamZero 的难题表现被指标掩盖 — wandb · 2026-07-23
- NVIDIA 挑战赛冠军方案:记忆模式与推理时搜索验证 — NVIDIAAI · 2026-07-23
- 威斯康星大学获美能源部多项 AI 资助,攻关能源挑战 — KyleCranmer · 2026-07-23
- LMSYS 新训练法 OPD:让 Qwen3.5 推理提速 3 倍且精度提升 — ying11231 · 2026-07-23