Technion 研究:泛化是稳定性而非准确率,跨数据集可逆转模型排名

Technion · hf · 2026-10-02

Technion 团队提出重新审视 LLM 泛化能力:泛化应定义为同一输入在不同表述下输出的一致性与语义稳定性,而非单一格式上的聚合准确率——后者把鲁棒性与刷分混为一谈。

核心贡献:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →