早稻田研究警示:AI 焦点小组共识率高但常一致出错
早稻田大学研究者 Tengfei Shao 的 arXiv 论文用 LLM 智能体复现了 100 场真实人类的 Wason 四卡片逻辑谜题小组讨论,为每位参与者创建 AI 替身。结果显示 AI 小组达成一致的比例高达 98.7%,但其中约 74% 是「一致地错」,共识率远高于真实人群且错误高度趋同,为用 AI 替身焦点小组替代真人调研的可靠性敲响警钟。
2026-10-07 ~ 2026-10-07 · 2 条相关
- 早稻田实验:AI 智能体小组 98.7% 达成一致,其中 74% 一致地错 — alex_verem · 2026-10-07
- 研究复现100场人类讨论:AI 智能体组共识率虚高,常一致地错 — alex_verem · 2026-10-07