AMD V620 显卡跑 Qwen 27B 与 Gemma A4B 基准测试结果

Brave_Load7620 · reddit · 2026-08-22

一位开发者分享了在 Windows 11 上使用 AMD V620 显卡(通过 Vulkan 和 ROCm 后端)运行 llama.cpp 的基准测试结果。测试对比了 Qwen 27B 和 Gemma A4B 在不同上下文深度(约 3.4k 到 26.6k tokens)下的预填充(PP)和生成速度。测试配置显示,Gemma 模型在 ROCm 后端下表现优异,生成速度远超 Qwen,尤其是在长上下文场景下。作者仍在优化标志和设置。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →