TypesafeAI 预告弃用公开评测:榜单在奖励作恶者

hardimanjames · x · 2026-09-17

初创模型公司 TypesafeAI 的人公开表示,公众觉得模型聪明(公开评测表现好)并不是好信号,因为公开评测体系会奖励 bad actors。团队已预先承诺降低公开评测的权重——即使成绩好看也不强调,选择用真实可靠性「笨办法」长期建立信任。帖子本身是营销口吻,但引用内容反映了小实验室对评测文化与信任建立的立场。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →