Nebius 推理端点准确性登顶,GLM-5.2 服务速度近 300 tokens/s

songhan_mit · x · 2026-08-06

Nebius 在 Artificial Analysis 测试中,服务 GLM-5.2 的端点准确性排名第一,达到参考端点 100% 性能,同时输出速度接近 300 tokens/s,处于准确性和速度的帕累托前沿。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →