LabHub
学习 学习路径 课程

HPC 与 Slurm

测验:批处理调度器

在 LabHub 中继续学习

在 Slurm 中,什么负责节点间守护进程通信的凭据?

Slurm 中的“分区(Partition)”最接近什么概念?

为了让回填(backfill)调度良好运作,用户应怎么做?

通过 --gres=gpu:1 获得资源的作业若试图使用两块 GPU,会怎样?

节点进入 DRAIN 状态。修复原因后还要做什么?

为什么 --cpus-per-task 的值在实践中很重要?