Nebius 推理端点准确性登顶,GLM-5.2 服务速度近 300 tokens/s
songhan_mit · x · 2026-08-06
Nebius 在 Artificial Analysis 测试中,服务 GLM-5.2 的端点准确性排名第一,达到参考端点 100% 性能,同时输出速度接近 300 tokens/s,处于准确性和速度的帕累托前沿。
「Infra」频道最新
- Jeff Dean 等科学家因 TPU 限制研究而离开 Google — firstadopter · 2026-08-06
- ARCHead:大模型输出头量化新方法,存储大幅降低且几乎无损 — Şuayp Talha Kocabay · 2026-08-06
- 8张 V100 能否支撑 50 人团队的 DeepSeek 本地推理? — MKU64 · 2026-08-06
- RTX 5090搭配96GB内存对本地AI工作流提升大吗? — Beastly4k · 2026-08-06
- 英伟达发布 RTX Spark 超级芯片:1 Petaflop 算力,重新定义 AI PC — nvidia · 2026-08-06
- 新 ComfyUI 节点让 Minimax H3 提速 4 倍、Krea 2 提速 5.6 倍 — Certain-Will-2769 · 2026-08-06