TMLR 收录新论文:CQ-Bench 评估模型文化智商

jieyuzhao11 · x · 2026-09-01

一篇关于 CQ-Bench 的论文已被 TMLR 接收。CQ-Bench 是一个专门用于评估大语言模型(LLM)对话中文化智商的基准,旨在测试模型是否像人类一样理解对话中隐含的文化价值观。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →