评测空间「有效秩」太低,研究者呼吁用连续基准提稳健性

ajratner · x · 2026-09-08

ajratner 转发 Dimitris Papail 关于评测集空间「有效秩」(effective rank)的分析,认为评测空间的多样性不足,行业需要共同努力提高它。他还引用 Ryan Marten 提出的「continuous benchmarks(连续基准)」思路,作为提升评测速率与鲁棒性的进展案例。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →