CAIS 评测上线:Astra 与 Grok 4.7 在准确率和 token 用量两端背反

polynoamial · x · 2026-09-24

CAIS 与 Scale AI 的评测网站新增内容,一张图表显示 Astra 和 Grok 4.7 分别处在准确率榜单和 token 消耗榜单的两端:一个准确但 token 用量高,另一个表现相反,「精度 vs 用量」的取舍对比颇具戏剧性。原帖人 Noam Brown 引用了该图表并乐见其被收录到官网。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →