RTX 5080 16GB 跑 Qwen 27B 真 Q4:61K 上下文 13 tok/s 调优实录

nofuture09 · reddit · 2026-09-02

Reddit 用户分享在 RTX 5080 16GB 上本地运行 Qwen3.8-27B 的完整调优过程,目标是保住真 Q4KM 量化的同时实现深上下文可用:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →