计划自费百美元 benchmark Qwen 量化与 KV 缓存

m_mukhtar · reddit · 2026-08-25

社区成员计划花费约 100 美元在云 GPU 上对 Qwen 2.5-72B(原文误写为 3.8-27B,结合上下文推测应为 72B 或同量级模型)进行深度基准测试。重点对比不同量化等级(Q4-Q6)、KV 缓存精度(8-bit vs 16-bit)、后端(GGUF vs EXL3)在本地编码和 Agent 任务中的实际表现与 Token 效率,而非单纯的跑分。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →