Qwen 2.5 27B 登陆 RTX 5090,推理速度超 100 tok/s

Hesamation · x · 2026-08-18

实机演示显示,Qwen 2.5(推文中误标为 Qwen 3.8)27B 模型在 NVIDIA RTX 5090 显卡上本地运行,推理速度超过 100 tok/s。这表明半年前的前沿模型性能如今已在消费级硬件上触手可及。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →