开发者批评 AI 模型评测沦为「质量洗白」工具

开发者 cocktailpeanut 发文指出,AI 模型评测正越来越多地被用于「质量洗白」:厂商选取看似合理的代理指标,仅以模型在该指标上的表现来证明其更优,却从未建立这些代理指标与模型真实质量之间的关联。这一观点引发业界对评测方法可信度的讨论与批评。

2026-08-18 ~ 2026-08-18 · 2 条相关