基准得分越细越危险:18 个任务分让排名损失近翻两番

sanmikoyejo · x · 2026-10-01

同一团队继续解释攻击原理:得分粒度是关键变量。以 LiveBench 为例,把返回的总分换成 18 个分任务分数后,8 次提交内的平均模型选择损失几乎翻了两番(约 4 倍)——细粒度反馈大幅放大了信息泄露。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →