태그: #cluster
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 5 편
Redis 프로덕션 운영 완전 가이드 2025: 클러스터, 영속화, 메모리 관리, Redis 7+ 기능
Redis 프로덕션 운영의 모든 것! 8가지 데이터 구조, 영속화(RDB vs AOF), Sentinel vs Cluster, 메모리 관리(maxmemory-policy), 성능 튜닝, Redis 7+ 새 기능, Valkey/KeyDB 비교, 모니터링과 문제 해결.
2026-04-15 · 14 분 읽기 #redis#cache#production#cluster#persistenceRedis 클러스터 고가용성 운영 가이드: Sentinel, Cluster 모드, 장애 복구 전략
Redis Sentinel과 Cluster 모드의 아키텍처 차이, 구성 방법, 장애 감지와 자동 페일오버 메커니즘, 그리고 프로덕션 운영에서의 트러블슈팅과 성능 튜닝을 다룹니다.
2026-03-14 · 29 분 읽기 #redis#database#high-availability#cluster#sentinelMongoDB Sharding과 Replica Set 운영 가이드: 클러스터 설계부터 트러블슈팅까지
MongoDB 분산 아키텍처의 핵심인 Sharding과 Replica Set 운영을 심층적으로 다룹니다. Shard Key 선택 전략, Replica Set 페일오버, Chunk 마이그레이션, 밸런서 관리, 백업/복구, 모니터링까지 프로덕션 클러스터 운영의 전체를 코드와 함께 구현합니다.
2026-03-13 · 19 분 읽기 #database#mongodb#sharding#replica-set#clusterRedis 클러스터 아키텍처와 고가용성 운영 가이드: Sentinel·Cluster 모드·메모리 최적화·장애 복구
Redis Standalone·Sentinel·Cluster 세 가지 배포 모드를 비교하고, Sentinel 쿼럼 기반 장애 감지·자동 페일오버, Cluster 해시 슬롯·리샤딩·PSYNC 복제, maxmemory 정책·LRU/LFU 축출, RDB/AOF 영속화, 슬로우 로그 분석, 메모리 단편화 대응, Split-brain·OOM 장애 시나리오와 복구 절차를 실전 예제로 정리합니다.
2026-03-12 · 22 분 읽기 #database#redis#cluster#sentinel#high-availabilitySlurm 완전 정복: HPC/AI 클러스터 워크로드 매니저 실전 가이드
Slurm 워크로드 매니저를 완전 정복한다. 아키텍처(slurmctld/slurmd/slurmdbd), 핵심 개념(파티션/QoS/Fairshare), 필수 명령어(sbatch/srun/salloc), GPU 스케줄링(GRES/MIG/MPS), 다중 노드 분산 학습(PyTorch DDP/DeepSpeed/Horovod), 컨테이너 통합(Singularity/Enroot+Pyxis), 설정·모니
2026-03-01 · 17 분 읽기 #slurm#hpc#gpu#distributed-training#cluster