AMD V620 显卡跑 Qwen 27B 与 Gemma A4B 基准测试结果
Brave_Load7620 · reddit · 2026-08-22
一位开发者分享了在 Windows 11 上使用 AMD V620 显卡(通过 Vulkan 和 ROCm 后端)运行 llama.cpp 的基准测试结果。测试对比了 Qwen 27B 和 Gemma A4B 在不同上下文深度(约 3.4k 到 26.6k tokens)下的预填充(PP)和生成速度。测试配置显示,Gemma 模型在 ROCm 后端下表现优异,生成速度远超 Qwen,尤其是在长上下文场景下。作者仍在优化标志和设置。
「Infra」频道最新
- 曝 Nvidia 60亿美元许可 Poolside 模型工厂,另投10亿估值120亿 — rohanpaul_ai · 2026-08-23
- 5090 售价虽高,22 天即可回本云端推理成本 — unchikuso · 2026-08-23
- 美光拟投百亿美元建爱达荷实验室,发力先进内存与计算 — Beth_Kindig · 2026-08-23
- AI 建巨型数据中心:小城居民对「印钞机」的复杂心态 — kyliebytes · 2026-08-23
- NVIDIA Rubin 10x 性能?专家指其仅限极高并发场景 — zephyr_z9 · 2026-08-23
- 笑中带泪的创业点子:用愤怒煮沸水为数据中心供电 — djcows · 2026-08-23