Qwen 27B dense在RTX 3090上跑出40 tok/s,本地AI的浪漫

danbri · x · 2026-08-14

作者分享在RTX 3090上运行Qwen 27B dense模型的体验:3月时35 tok/s,4月提升至40 tok/s,21GB显存占用,可加载完整262k上下文。强调dense模型所有参数参与计算,性能可预测,且无需联网或订阅。认为这是本地AI的典范。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →