Qwen 3.8 27B 实测:KV Cache f16 精度优于 q8_0

Felixls · reddit · 2026-08-20

作者在 AMD R9700 + ROCm 环境下测试 Qwen 3.8 27B 模型,发现 KV Cache 使用 f16 精度时,模型在结构化和自由输出上比 q80 更细致,思维链更准确,且在 12 万上下文后仍能保持记忆。作者指出此前一些差评可能源于测试了 q40 等低精度 KV Cache。附带了详细的 llama.cpp 配置文件。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →