Quad 3090 跑 Qwen3.8-Flash-Next-NVFP4,单卡 120 tok/s
QuixiAI · x · 2026-09-07
QuixiAI 宣布在四张 RTX 3090 上用 SlimServe 跑通 nvidia/Qwen3.8-Flash-Next-NVFP4,并发 1 时约 120 tok/s,并发 8 时达 361.7 tok/s,使用其自研的 P2P 驱动 QuixiAI/open-gpu-kernel-modules。
所属事件:旧款 RTX 3090 跑 Qwen3.8-Flash-Next:8 卡 1200 tok/s(2 条相关)→
「Infra」频道最新
- Dell COO:AI 需求超过供给,DRAM、NAND、CPU、磁盘全面短缺 — mattwbaker · 2026-09-07
- 双 R9700 64GB 本地跑 Qwen3.8:全套 4 千欧,解码 111 tok/s — smallDeltaBigEffect · 2026-09-07
- Reddit 实测:调两个采样参数,NVFP4 量化 Qwen3.8-27B 追平 BF16 — UmpireBorn3719 · 2026-09-07
- $700 预算装本地 LLM:魔改卡与矿卡选购求助帖 — Current-Set1963 · 2026-09-07
- 对话:AI 算力瓶颈尚未过热,下一个约束是能源 — kimmonismus · 2026-09-07
- Google 与 Fervo 签 396MW 地热协议,可选增至约 1GW 供数据中心 — Beth_Kindig · 2026-09-07