用 vLLM 补丁在 DGX Spark 上实测:DiffusionGemma 打平并跑赢商用 API
vllm_project · x · 2026-10-06
开发者 HOTHEAD01TH 为 vLLM 写了自定义补丁,让 DiffusionGemma 以「Jev 替代」方式在 DGX Spark 上本地运行,并与商用 API 做 live 评测:速度上并未更慢,智能程度上两者基本打平,综合表现 DiffusionGemma 更胜一筹。vLLM 官方转发了这项工作,呼吁将补丁贡献回上游。
「Infra」频道最新
- AI 供应链分析:生益科技正赢得英伟达生态 CCL 订单 — zephyr_z9 · 2026-10-06
- Mistral ML4 广度评测达开源 SOTA,安全任务漏洞修复得分 82% — GuillaumeLample · 2026-10-06
- ML4 用 3800 块 Grace Blackwell 训练,Mistral 两轮新集群在路上 — GuillaumeLample · 2026-10-06
- vLLM Semantic Router 主打「模型混合路由」,实测指令显著改变 Agent 工具调用 — colinmcnamara · 2026-10-06
- NVIDIA 电信报告:89% 运营商视开放模型为 AI 战略关键 — NVIDIAAI · 2026-10-06
- 代码算数模型说话:独立开发者根治本地小模型编造账目 — Revibed69 · 2026-10-06