CMW 研究:CCBench 用健康问句测 LLM 隐性文化规范理解力

MaartenSap · x · 2026-10-07

NLP 研究者 Maarten Sap 在会议现场展示系列学生项目,其中第 10 项为 CCBench:通过健康查询中隐含信号的文化规范,评估 LLM 的文化胜任力——测试模型能否在用户从未明确说明的情况下识别出文化相关的规范。该工作在会议第 6 场以海报形式展示。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →