Wally 推理栈发布:GLM-5.3 Max 达 790 tok/s 主打开源模型高速推理

ycombinator · x · 2026-09-22

RunAnywhereAI 发布 Wally,一个面向开源前沿模型的推理栈,主打"最快的运行地"。性能快照:GLM-5.3 Flash 380 tok/s、GLM-5.3 Max 790 tok/s、Qwen3.8-27B 485 tok/s、DeepSeek-V4.1 Flash 615 tok/s。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →