一条 gcloud 命令上云跑 DiffusionGemma,RTX 6000 Blackwell 约 $3/小时
bodonoghue85 · x · 2026-09-21
开发者基于 @mmastrac 的 DiffusionGemma-Jev(djev)项目开源了 djev-run,可在 Google Cloud Run 上用一条 gcloud 命令部署 NVIDIA RTX PRO 6000 Blackwell GPU,对外提供 Jev API 兼容端点,活跃时约 $3/小时,闲置时不计费——不用花大价钱搭本地 Blackwell 环境就能体验扩散式语言模型。
部署流程分两步:
- 先创建 GCS bucket,用 hf download 拉取 nvidia/diffusiongemma-26B-A4B-it-NVFP4 权重并上传
- 再用 gcloud beta run deploy 指定 --gpu=1 --gpu-type=nvidia-rtx-pro-6000、20 vCPU、80Gi 内存、concurrency=32、min-instances=0 等参数部署,模型权重通过 Cloud Storage 卷挂载
支持区域为 us-central1、europe-west4、asia-southeast1、asia-south2,项目已开源在 GitHub(taeold/djev-run),README 标注遵循 Cloud Run GPU 最佳实践。
「Infra」频道最新
- Qdrant 实测检索候选深度:扩到 500 只提升上限 0.28,实际分数几乎不动 — qdrant_engine · 2026-09-21
- gemini-cli 修复会话退出挂起:stdin、MCP 子进程清理全链路补丁 — Pcmhacker-piro · 2026-09-21
- lemire 实测:CPU 每个周期到底能处理多少条分支指令 — lemire · 2026-09-21
- Qwen3.8-27B 原生 8 位在 M5 Pro 跑出 37-55 tok/s,破解 4 位量化推理断崖 — SnooPredictions515 · 2026-09-21
- 谷歌提出 Orphaned VMs:主机内核停机更新时虚拟机照常运行 — jedisct1 · 2026-09-21
- 16GB 显存才是大多数人的天花板,本地模型生态该围绕它优化 — ECrispy · 2026-09-21