双 R9700 跑 Qwen 3.8 27B FP8:RDNA4 推理配置征集更优方案
N34257 · reddit · 2026-10-06
发帖人在双 AMD R9700(RDNA4)上用 vllm-radiance 引擎跑 Qwen 3.8 27B FP8,成绩为 5000 tok/s prefill 和 130+ tok/s 代码生成,想了解在专用推理引擎层出不穷的当下是否有更优配置。特别关注能跑 Qwen 3.8 Flash Next 的方案——vllm-radiance 尚不支持,又不愿退回 llama.cpp 的性能水平,征求 RDNA4 上的替代引擎建议。
「Infra」频道最新
- Drax 拟烧 490 万吨木材供电数据中心,排放近两倍于盖特威克航班 — nordicinst · 2026-10-06
- 数据中心商 DayOne 递交美股 IPO:上半年营收 5.12 亿美元,净亏扩大至 7720 万 — zephyr_z9 · 2026-10-06
- Strata 宣称 6GB 显存即可实现 5090 级推理性能 — lxfater · 2026-10-06
- ComfyUI 跑 Flux:13 款 GPU 实测对比基准发布 — Ok_Contribution8157 · 2026-10-06
- ODS 一键部署本地 AI:自动检测硬件、装模型、带 Agent 与插件 — Teknium · 2026-10-06
- PlanetScale 工程师长文:从手跑 Postgres 讲透 Kubernetes 反馈循环 — bibryam · 2026-10-06