閉域網インフラ
インターネットが遮断された網でインストールが通るようにします。pip・npm・Maven・Go・dnf の社内ミラーとプライベート CA を立て、GPU ドライバーと CUDA を持ち込んでインストールし、Slurm でジョブを割り振り、Kubernetes では GPU Operator でドライバーからメトリクスまで管理します。公共・金融・研究所の現場でサーバーを引き継いだときの、最初の一週間の手順です。
코스
- 閉域網のミラーとプライベート CA — 取ってくる側と使う側、社内ミラーと信頼ストア。
- 閉域網へのGPUドライバ搬入と導入 — USB一往復で終える搬入手順。
- HPCとSlurm — GPU八枚を複数人で分け合う方法。
- GPU Operatorとタイムスライシング — GPU四枚を一度に使えなくした事故から出発します。