Qwen3.8 Flash Next 混合显卡部署实测求助

Designer_Elephant227 · reddit · 2026-08-31

用户尝试在混合显卡环境(RTX 5070 Ti 16GB + Radeon AI PRO R9700 32GB + 96GB RAM)下本地运行 Qwen3.8 Flash Next 模型,但遇到困难。用户此前成功运行 27b 模型(q8 量化,256k 上下文,40tok/s)。目前遇到 AMD Pro 驱动卸载 Bug 导致系统死机,以及 Claude 误判 MoE 模型显存需求的问题。作者请求社区提供具体的量化方案、吞吐量数据、启动参数以及混合 NVIDIA/AMD 环境的处理经验。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →