双 RTX 3090 跑 Flash-Next:Go-LLM 指南给出完整 vLLM 部署配方

Motor_Ad16 · reddit · 2026-09-15

作者 majidkorai 开源了 Go-LLM 仓库,整理了用 vLLM 运行 Qwen3.8-Flash-Next 的完整工作笔记,只含指南/配置/脚本,不含模型权重与私有设施。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →