Meta等AI厂商基准测试成绩遭质疑

近期AI基准测试的公正性受到社区强烈质疑,Meta等大厂被指定制数据以美化跑分。评论特别点名Meta AI负责人,指出其参与设计的“人类最后考试”基准中,模型表现实际不及GPT-4o和Claude Opus。社区呼吁开发者保持批判性思维,不要盲从厂商发布的成绩,认为当前的AI榜单正变得越来越无关紧要。

2026-07-09 ~ 2026-07-09 · 2 条相关