弃用 K8s,Slurm 搞定本地 GPU 多团队调度

Ubunta · x · 2026-08-17

作者分享在处理敏感临床笔记时的本地 GPU 调度经验。面对多团队抢资源导致的调度混乱,在评估了 Ray、K8s 和 Celery 后,选择 HPC 常用的 Slurm。Slurm 不仅完美处理资源分配,其 sacct 命令还自动保留了详尽的作业历史记录,省去了单独构建追踪系统的麻烦。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →