双 R9700 跑 Qwen 3.8 27B FP8:RDNA4 推理配置征集更优方案

N34257 · reddit · 2026-10-06

发帖人在双 AMD R9700(RDNA4)上用 vllm-radiance 引擎跑 Qwen 3.8 27B FP8,成绩为 5000 tok/s prefill 和 130+ tok/s 代码生成,想了解在专用推理引擎层出不穷的当下是否有更优配置。特别关注能跑 Qwen 3.8 Flash Next 的方案——vllm-radiance 尚不支持,又不愿退回 llama.cpp 的性能水平,征求 RDNA4 上的替代引擎建议。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →