태그: #autoscaling
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 5 편
Kubernetes Pod Pending 상태 해결 — 스케줄러가 남긴 거절 사유 읽는 법
파드가 Pending에서 몇 분째 넘어가지 않을 때, 스케줄러는 이미 거절 사유를 이벤트에 남겨 두었습니다. 0/5 nodes are available로 시작하는 그 문장을 정확히 해독하는 법부터 시작해 아홉 갈래 원인을 하나씩 배제합니다. 리소스 부족은 실제 사용량이 아니라 requests 총합으로 판정된다는 점, taint와 톨러레이션, 노드 셀렉터와 어피니티 불일치, PVC 미바인딩과
2026-07-26 · 20 분 읽기 #kubernetes#scheduler#pending#troubleshooting#autoscalingKubernetes 오토스케일링 완벽 가이드: HPA·VPA·KEDA 기반 프로덕션 워크로드 자동 확장 전략
Kubernetes HPA v2의 커스텀 메트릭 기반 수평 확장, VPA의 리소스 자동 조정, KEDA의 이벤트 기반 스케일링을 심층 비교. 메트릭 서버 구성, 스케일링 알고리즘, Cooldown 전략, 복합 스케일링 패턴, 장애 사례와 복구 절차, 프로덕션 체크리스트를 다룹니다.
2026-03-11 · 24 분 읽기 #kubernetes#autoscaling#hpa#vpa#kedaKubernetes HPA·VPA·KEDA 오토스케일링 전략과 실전 튜닝 가이드
Kubernetes HPA, VPA, KEDA의 동작 원리부터 커스텀 메트릭 기반 스케일링, 혼합 전략, 실전 튜닝과 트러블슈팅까지 다루는 종합 오토스케일링 가이드.
2026-03-06 · 18 분 읽기 #kubernetes#hpa#vpa#keda#autoscalingKarpenter 실전 가이드 — Kubernetes 노드 오토스케일링의 새로운 패러다임
Cluster Autoscaler를 대체하는 Karpenter의 핵심 아키텍처부터 NodePool, EC2NodeClass 설정, 통합(Consolidation) 전략, 실전 운영 팁까지 코드 예제와 함께 다룹니다.
2026-03-03 · 13 분 읽기 #kubernetes#karpenter#autoscaling#eks#2026-03Kubernetes VPA + In-Place Pod Resize 실전 가이드 — 재시작 없는 리소스 자동 조정
Kubernetes 1.35에서 GA된 In-Place Pod Resize와 VPA의 InPlaceOrRecreate 모드를 결합하여, Pod 재시작 없이 CPU/메모리를 자동 조정하는 실전 가이드. 설정부터 모니터링까지 코드 예제와 함께 다룹니다.
2026-03-03 · 9 분 읽기 #kubernetes#vpa#autoscaling#in-place-resize#2026-03