128GB 显存怎么跑?玩家在 Qwen、GLM、DeepSeek 量化版之间纠结
Madigan37 · reddit · 2026-09-10
一位玩家升级到 128GB VRAM 后发帖征询跑什么模型。他倾向 Qwen3.8 Flash-Next 的 Q4 量化,原则是不跑 Q4 以下;但考虑到社区对 Flash-Next 的反响平平,他也在考虑 Q2 的 GLM 5.3,或 Q2/Q3 的 DeepSeek 4 Flash。他表示三个都会试,想听听同等配置用户的实际选择和体验。
「Infra」频道最新
- Autonomous 双 5090 工作站加入 Omarchy 系统,售价 2.6 万美元 — dee_hw · 2026-09-10
- 1 亿输出 token 仅 60 美元:DeepSeek 峰谷定价碾压 Opus 5 — airesearch12 · 2026-09-10
- 开发者观察:token 需求增速将远超顶级智能需求 — willcb · 2026-09-10
- Arm 获联想与字节火山引擎成其 AI 服务器芯片首批中国客户 — pstAsiatech · 2026-09-10
- 推理芯片商 d-Matrix 接入 NVIDIA NVLink Fusion,Raptor XPU 将上机架 — nordicinst · 2026-09-10
- 开源也能赚钱?转:DeepSeek 或因架构优势成为唯一有利润的推理提供方 — yacineMTB · 2026-09-10