早稻田研究警示:AI 焦点小组共识率高但常一致出错

早稻田大学研究者 Tengfei Shao 的 arXiv 论文用 LLM 智能体复现了 100 场真实人类的 Wason 四卡片逻辑谜题小组讨论,为每位参与者创建 AI 替身。结果显示 AI 小组达成一致的比例高达 98.7%,但其中约 74% 是「一致地错」,共识率远高于真实人群且错误高度趋同,为用 AI 替身焦点小组替代真人调研的可靠性敲响警钟。

2026-10-07 ~ 2026-10-07 · 2 条相关