4090 本地跑 Qwen 27B:近100 token/s

cocktailpeanut · x · 2026-08-16

用户 zast57 在 RTX 4090 上通过 Ollama + OpenWebUI(经 Pinokio 一键部署)本地运行 Qwen 3 系列 27B 模型(原帖写作 Qwen 3.28:27b),实测生成速度:

他对这个速度表示惊喜。Pinokio 作者 cocktailpeanut 转发了该实测。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →