隔离网络基础设施
让安装在被隔离于互联网的网络中也能完成。为 pip、npm、Maven、Go 与 dnf 搭建内部镜像源和私有 CA,把 GPU 驱动和 CUDA 带入并安装,用 Slurm 分配作业,在 Kubernetes 上用 GPU Operator 管理从驱动到指标的一切。这是在公共、金融或研究机构接手服务器时第一周要做的事的顺序。
코스
- 隔离网络镜像与私有 CA — 下载端与使用端,内部镜像与信任库。
- 闭网环境的 GPU 驱动搬入与安装 — 一趟 U 盘就搞定的搬入流程。
- HPC 与 Slurm — 多人分享八张 GPU 的方法。
- GPU Operator 与时间片 — 从一次让四张 GPU 同时失效的事故讲起。