研究:LLM 调查响应虽似真但缺乏心理测量效度

Mantas Lukauskas · hf · 2026-08-18

这项研究对大语言模型作为合成调查受访者的适用性进行了心理测量审计。结果显示,虽然 LLM 能在合成响应中复制广泛的心理测量趋势,但在匹配人类联合分布、信度和中介结构方面表现失败。结论认为 LLM 目前尚不适合替代真实受访者进行严谨的社会科学调查。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →