EMNLP 论文:LLM 模拟对话远比真人更「配合」,难复现冲突行为

peizNLP · x · 2026-09-12

Ryo Kamoi 等人的论文被 EMNLP 2026 接收,研究 LLM 模拟人类社交对话的可靠性。作者指出真实人类对话充满不一致与非协作行为(误解、打断等),合格的 LLM 模拟应能以接近真实频率复现这些行为。

团队提出 CoCoEval 评估框架:

用 CoCoEval 对比真人对话与 GPT-4.1、GPT-5.1、Claude Opus 4 的模拟对话,发现:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →