研究:仅凭用户消息即可识别 WildChat、LMSYS 等数据集来源
serinachang5 · x · 2026-10-08
Joseph J. Suh 等人的新论文检验 WildChat、LMSYS、ShareChat 等人机交互数据集是否真的描绘同一幅「真实世界 AI 使用」图景。结论是并不相同:仅从用户消息出发,分类器就能准确判断一条对话来自哪个数据集,说明各数据集带有强烈的来源签名。这些签名会从 HAI 数据集传播到用户模型,再到助手评测,影响整条研究管线的结论。
所属事件:研究发现数据集签名会沿用户模型污染助手评测(3 条相关)→
「研究」频道最新
- KERNAUT:用 LLM 写核函数程序,自动发现可解释科学模型 — sirbayes · 2026-10-08
- Kernaut 用发现的核函数预测血糖,超越最优调参标准核 — sirbayes · 2026-10-08
- Kernaut 论文:让编程 agent 以程序搜索方式自动设计 GP 核函数 — sirbayes · 2026-10-08
- Kernaut 发现的核函数可解释:16 个标量函数的内积形式 — sirbayes · 2026-10-08
- iOSWorld 亮相 COLM 2026:专注 iOS 环境的计算机使用 Agent 基准 — kohjingyu · 2026-10-08
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08