태그: #high-availability
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 8 편
홈랩 쿠버네티스 3노드에서 7노드로 — 컨트롤 플레인 확장, etcd 쿼럼, 그리고 "조인만 하면 HA"라는 착각
워커 2대와 컨트롤 플레인 2대를 추가해 홈랩을 7노드로 확장했습니다. kubeadm의 certificate-key가 왜 2시간짜리인지, etcd 멤버 3개가 실제로 어떻게 등록되는지를 실측으로 기록했습니다. 그리고 가장 중요한 발견 — etcd 쿼럼을 갖췄다고 HA가 되는 게 아니었습니다. 엔드포인트가 물리 IP에 고정된 클러스터에서 첫 노드가 죽으면 무슨 일이 벌어지는지, 인증서 재발급
2026-08-28 · 15 분 읽기 #kubernetes#kubeadm#etcd#high-availability#homelabIngress Controller 고가용성과 스케일링
Ingress 컨트롤러를 무중단으로 운영하기 위한 고가용성 토폴로지(DaemonSet vs Deployment+HPA), 노출 방식별 HA, graceful drain과 무중단 배포, reload 영향 최소화, leader election, 멀티 AZ, 대규모 ingress 객체 성능, 리소스 사이징, 부하 테스트, 장애 시나리오를 정리한 운영 가이드입니다.
2026-06-14 · 19 분 읽기 #ingress#kubernetes#nginx#high-availability#networkingPostgreSQL 복제 완전 가이드 2025: Streaming Replication, Logical Decoding, Failover, Patroni 심층 분석
PostgreSQL의 모든 복제 방식을 완전 분석. Physical streaming replication, synchronous vs async, logical decoding, failover 자동화 (Patroni), PgBouncer까지 — production PostgreSQL 운영의 모든 것을 720줄로 파헤친다.
2026-04-15 · 36 분 읽기 #postgresql#replication#wal#streaming-replication#logical-decodingRedis 클러스터 고가용성 운영 가이드: Sentinel, Cluster 모드, 장애 복구 전략
Redis Sentinel과 Cluster 모드의 아키텍처 차이, 구성 방법, 장애 감지와 자동 페일오버 메커니즘, 그리고 프로덕션 운영에서의 트러블슈팅과 성능 튜닝을 다룹니다.
2026-03-14 · 29 분 읽기 #redis#database#high-availability#cluster#sentinelRedis 클러스터 아키텍처와 고가용성 운영 가이드: Sentinel·Cluster 모드·메모리 최적화·장애 복구
Redis Standalone·Sentinel·Cluster 세 가지 배포 모드를 비교하고, Sentinel 쿼럼 기반 장애 감지·자동 페일오버, Cluster 해시 슬롯·리샤딩·PSYNC 복제, maxmemory 정책·LRU/LFU 축출, RDB/AOF 영속화, 슬로우 로그 분석, 메모리 단편화 대응, Split-brain·OOM 장애 시나리오와 복구 절차를 실전 예제로 정리합니다.
2026-03-12 · 22 분 읽기 #database#redis#cluster#sentinel#high-availabilityCockroachDB 실전 운영 가이드: 분산 SQL NewSQL 아키텍처와 프로덕션 전략
CockroachDB의 분산 SQL 아키텍처부터 프로덕션 운영까지 다루는 실전 가이드. Raft 합의 알고리즘, 멀티 리전 토폴로지, 스키마 변경 전략, 성능 튜닝, 장애 복구 절차와 다른 NewSQL 데이터베이스와의 비교까지 종합적으로 정리합니다.
2026-03-08 · 34 분 읽기 #database#cockroachdb#distributed-sql#newsql#high-availabilityRedis Cluster 구축과 운영 실전 가이드 — 샤딩, 레플리케이션, 페일오버
Redis Cluster의 아키텍처부터 6노드 클러스터 구축, 해시 슬롯, 자동 페일오버, 리샤딩까지 운영에 필요한 모든 것을 실전 코드로 다룹니다.
2026-03-03 · 52 분 읽기 #database#redis#redis-cluster#sharding#high-availability이중화·삼중화 완전 가이드 — 99.999% 가용성의 비밀
서버 이중화부터 삼중화, Active-Standby, Active-Active, N+1, 스플릿 브레인, 쿼럼까지. 99.9%와 99.999%의 차이가 연간 다운타임 8시간 vs 5분인 이유를 실전 아키텍처로 설명합니다.
2026-03-02 · 11 분 읽기 #architecture#high-availability#redundancy#failover#load-balancing