RTX 5060 Ti 16GB 跑 Qwen3.8-27B:IQ4 量化与全功能实测

Tema_Art_7777 · reddit · 2026-08-22

作者在 RTX 5060 Ti 16GB 上测试 Qwen3.8-27B 模型,旨在验证其在单卡上运行 64K 上下文、视觉及 Agent 工具调用的能力。测试对比了 jpetrina IQ4XS-pure、Unsloth UD-IQ4XS 和 Q80 版本。结果显示,Unsloth UD-IQ4XS 配合 MTP-1 可在 64K 上下文下维持约 45 tok/s,且困惑度极接近 Q8 基准。视觉功能(F16 投影器)运行正常,但与 64K 上下文同时开启显存捉襟见肘,建议分档配置。在 BFCL 工具调用评测中,27B 模型的多轮对话表现明显优于 Qwen3.5-9B,成功处理了依赖调用和提示注入抵抗等复杂场景。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →