llama.cpp 基准显示 ROCm 与 Vulkan 在 AMD R9700 上互有胜负
Gesha24 · reddit · 2026-07-28
一位用户在 AMD Radeon AI PRO R9700 上对 ROCm 7.14 和 Vulkan 版 llama.cpp 做了详细基准对比,结果并没有出现简单粗暴的“谁一定更快”。
帖子把硬件、编译参数和模型都列得很完整,测试了 E4B-Q4、Gemma 31B Q4、Qwen 27B Q6 等模型。在短上下文场景里,ROCm 在部分 prompt processing 上更快,但 Vulkan 在另一些模型和生成指标上反超;在长上下文测试里,双方优势又会随模型和指标切换。
结论是:在这类 RDNA4 本地推理场景里,后端选择会显著影响吞吐,但优势并不是一边倒,而是取决于模型大小和上下文模式。
「Infra」频道最新
- Kimi K3 在 AMD MI350X 上跑通,四路并发达 327 tok/s — burny_tech · 2026-07-28
- Kimi K3 据称沿用 block attention residuals,模型共 93 层 — burny_tech · 2026-07-28
- NASA 新任管理员称 SpaceX 押注轨道数据中心将成真 — elonmusk · 2026-07-28
- Reddit 讨论解锁后的 CMP 170HX 能否支撑本地 AI 机架 — Tritheone69 · 2026-07-28
- 开源权重模型被视为大公司的安全部署方案 — jessi_cata · 2026-07-28
- Dolphin 基于 72 张 4090 训练 Trinity Large Thinking 398B — QuixiAI · 2026-07-28