EMNLP 论文实测:每个 LLM 都在自己生成的基准上排第一

shangbinfeng · x · 2026-09-05

一项被 EMNLP 2026 主会接收的研究(arXiv:2509.26600)系统分析了「用 LLM 自动生成并评测基准」这一范式的根本缺陷:自我偏置(self-bias)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →