弃用 K8s,Slurm 搞定本地 GPU 多团队调度
Ubunta · x · 2026-08-17
作者分享在处理敏感临床笔记时的本地 GPU 调度经验。面对多团队抢资源导致的调度混乱,在评估了 Ray、K8s 和 Celery 后,选择 HPC 常用的 Slurm。Slurm 不仅完美处理资源分配,其 sacct 命令还自动保留了详尽的作业历史记录,省去了单独构建追踪系统的麻烦。
「Infra」频道最新
- 前沿智能降价如云存储,企业 AI 竞争转向路由与编排层 — krishnan · 2026-08-18
- 机器时代投资指南:算力、能源与稀缺资源的淘金逻辑 — 0xSammy · 2026-08-17
- 调查:追踪被 AI 公司收购的绝版书,竟运往亚马逊销毁扫描 — SatelliteNetSec · 2026-08-17
- OpenAI 与 Oracle 联手,谁来为百亿美元电力烂摊子买单 — aronchick · 2026-08-17
- 2024 年后成立的初创公司,你们用哪家云? — yenkel · 2026-08-17
- 马斯克:美国赢在当下,AI芯片制造决定未来胜负 — rohanpaul_ai · 2026-08-17