Qwen3.8 Flash Next 混合显卡部署实测求助
Designer_Elephant227 · reddit · 2026-08-31
用户尝试在混合显卡环境(RTX 5070 Ti 16GB + Radeon AI PRO R9700 32GB + 96GB RAM)下本地运行 Qwen3.8 Flash Next 模型,但遇到困难。用户此前成功运行 27b 模型(q8 量化,256k 上下文,40tok/s)。目前遇到 AMD Pro 驱动卸载 Bug 导致系统死机,以及 Claude 误判 MoE 模型显存需求的问题。作者请求社区提供具体的量化方案、吞吐量数据、启动参数以及混合 NVIDIA/AMD 环境的处理经验。
「Infra」频道最新
- 传 SK 海力士 HBM4E 基底裸片拟外发给英特尔代工 — AccBalanced · 2026-09-01
- 卫报提议数据中心自发电,实现零碳排放 — nordicinst · 2026-09-01
- 算力出地:将下一代智能基础设施搬入轨道的宣言 — McDonaghMatthew · 2026-09-01
- 优化 Qwen 3.8 Flash Next:大显存下提升预填与生成速度 — Jorlen · 2026-09-01
- AI 建设实际消耗多少电力? — TheZachMueller · 2026-08-31
- 实测三款 Claude Code 插件:如何有效降低 Token 成本 — Marmelab · 2026-08-31