2100次实测揭示开源模型逼近前沿,Grok性价比夺冠

andreisavu · x · 2026-07-30

Rippling 团队本周使用其私有智能体基准,对主流闭源与开源模型进行了约 2100 次实测评估。

结果显示,Grok 在性价比方面表现最佳,而智谱的 GLM 模型能力已极为接近前沿闭源模型。这表明开源与国产模型正在快速缩小与头部实验室的差距。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →