Yoniq Compute 开源:H200 验证的 SGLang/vLLM 部署配方
TheZachMueller · x · 2026-09-24
keennay 发布 Yoniq Compute 仓库,提供快速搭建 Linux ML 工作负载节点的脚本,覆盖 SGLang/vLLM 推理配方的构建与服务。配方已在 1x/2x/4x/8x NVIDIA H200 上验证,覆盖 Ai2、DeepSeek、Google、Meta、Microsoft、MiniMax、Mistral、Moonshot、Qwen、NVIDIA 等 30 多家机构的模型。
「Infra」频道最新
- Nebius 二次上调 GPU 租价,H100 时租涨 17% 至 $4.50 — tengyanAI · 2026-09-24
- Nunchux 让 MiniMax-H3 在 AMD MI355X 上推理快 26.7 倍 — junyanz89 · 2026-09-24
- 按 API 价格估算,OpenAI 研究员日烧 token 或超 400 万美元 — abtin · 2026-09-24
- 用请求体而非路径后缀过滤:编码代理追踪的一次踩坑修复 — Greney_Yunan · 2026-09-24
- 把 LLM 当不可靠依赖治理:系统工程方法打通生产级落地 — _jaydeepkarale · 2026-09-24
- 中国智能算力已达 2185 EFLOPS,2030 年目标再增 4.5 倍 — ingliguori · 2026-09-24