タグ: #dra
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 2 件
Kubernetes v1.36 の Workload/PodGroup API — ギャングスケジューリングが kube-scheduler に入りつつある
AI学習・バッチワークロードのギャングスケジューリングは、これまでVolcanoやKueueといった外部スケジューラの仕事でしたが、Kubernetesはこの機能をコアに取り込み始めています。v1.35はWorkload APIと最初のギャングスケジューリング実装をアルファとして出し、2026年4月22日リリースのv1.36は構造を作り直し、Workloadを静的テンプレートに、新しいPodGroupをランタイムオブジェクトに分離して、
2026-07-16 · 33 分で読めます #kubernetes#scheduling#gang-scheduling#distributed-training#draKubernetes動的リソース割り当てとGPUスケジューリング
AI/MLワークロード向けのKubernetes動的リソース割り当て(DRA)とGPUスケジューリング戦略ガイド。
2026-03-06 · 29 分で読めます #kubernetes#dra#gpu#dynamic-resource-allocation#scheduling