Qwen3.8-27B 推理速度实测:3090 上约 30-32 tokens/s

CooLittleFonzies · reddit · 2026-08-17

Reddit 用户分享 Qwen3.8-27B 的本地推理速度:在 RTX 3090、64GB DDR4、AMD 7950x 配置下,使用 Q5KM GGUF 量化模型,输出速度约为 30-32 tokens/s。帖子旨在收集其他用户的硬件配置和速度数据,以便对比。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →