태그: #prometheus
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 35 편
관측성(Observability) 완전 가이드 2025: Prometheus, Grafana, OpenTelemetry로 시스템을 투명하게
관측성의 3가지 축(메트릭/로그/트레이스)을 완전 정복! Prometheus 쿼리(PromQL), Grafana 대시보드, OpenTelemetry 계측, Jaeger 분산 추적, ELK/Loki 로깅, 알림 전략, SLI/SLO/SLA, 온콜 문화까지.
2026-03-23 · 25 분 읽기 #observability#monitoring#prometheus#grafana#opentelemetryPrometheus TSDB 내부 구조: WAL, Chunks, Blocks, Compaction
Prometheus TSDB의 내부 구조를 소스코드 레벨에서 분석합니다. WAL 세그먼트 구조, Head Block의 memSeries와 청크 인코딩(XOR, delta-of-delta), 블록 구조, 컴팩션 알고리즘, 인덱스의 posting list까지 깊이 살펴봅니다.
2026-03-20 · 17 분 읽기 #prometheus#observability#open-source-internalsPrometheus 아키텍처 내부 분석: 소스코드 레벨 딥다이브
Prometheus 서버의 내부 아키텍처를 소스코드 레벨에서 분석합니다. Scrape Manager, TSDB, Rule Manager, Notifier, Web UI 등 주요 컴포넌트의 goroutine 모델과 생명주기 관리, 설정 리로드 메커니즘을 깊이 살펴봅니다.
2026-03-20 · 15 분 읽기 #prometheus#observability#open-source-internalsPromQL 엔진 내부 구조: 파서부터 실행 엔진까지
PromQL 엔진의 내부 구조를 소스코드 레벨에서 분석합니다. 렉서와 파서, AST 구조, 쿼리 평가 엔진의 instant query와 range query 처리, step 평가, lookback delta, 서브쿼리 구현, 메모리 관리까지 깊이 살펴봅니다.
2026-03-20 · 15 분 읽기 #prometheus#observability#open-source-internalsPrometheus 서비스 디스커버리 메커니즘 완전 분석
Prometheus 서비스 디스커버리의 내부 구조를 분석합니다. Discovery Manager 아키텍처, Provider 인터페이스, kubernetessd의 watch 메커니즘, relabeling 동작 원리, filesd와 HTTP SD, 타겟 생명주기를 소스코드 레벨에서 살펴봅니다.
2026-03-20 · 16 분 읽기 #prometheus#observability#open-source-internalsPrometheus 알림 파이프라인: Rule 평가부터 Alertmanager 전달까지
Prometheus 알림 파이프라인의 내부를 분석합니다. Rule Manager의 평가 메커니즘, Alert 상태 머신(inactive/pending/firing/resolved), for duration, Alertmanager의 라우팅 트리, 억제, 사일런싱, 그루핑, 중복 제거, 알림 전달 파이프라인, HA 클러스터 gossip까지 다룹니다.
2026-03-20 · 16 분 읽기 #prometheus#observability#open-source-internals[Golden Kubestronaut] PCA 실전 연습 문제 80제 - Prometheus Certified Associate
Golden Kubestronaut 달성을 위한 PCA(Prometheus Certified Associate) 실전 연습 문제 80제. Prometheus 아키텍처, PromQL, 알림, 서비스 디스커버리, 스토리지 등 전 도메인을 커버합니다.
2026-03-20 · 67 분 읽기 #kubernetes#golden-kubestronaut#prometheus#pca#certificationPrometheus 운영 실전 가이드: TSDB, 카디널리티, Recording Rules, Federation, Remote Write
Prometheus를 안정적으로 운영하기 위해 꼭 알아야 할 TSDB 보존 전략, 고카디널리티 대응, recording rules와 alerting rules 설계, federation과 remote write 선택 기준을 정리합니다.
2026-03-17 · 10 분 읽기 #prometheus#observability#tsdb#cardinality#recording-rulesPrometheus·Alertmanager 알림 파이프라인 구축: 규칙 작성부터 PagerDuty·Slack 라우팅까지
Prometheus와 Alertmanager를 활용한 프로덕션 알림 파이프라인을 구축합니다. PromQL 기반 알림 규칙 작성, Alertmanager 라우팅 트리 설계, PagerDuty·Slack 통합, Alert Fatigue 방지 전략까지 운영 중심으로 다룹니다.
2026-03-12 · 27 분 읽기 #observability#prometheus#alertmanager#grafana#pagerdutyPrometheus 운영 총정리 — 메트릭 수집, PromQL, 알림, 대시보드, 모범사례
Prometheus의 아키텍처부터 메트릭 수집, PromQL 쿼리, Alertmanager 알림 설정, Grafana 대시보드 연동, 그리고 대규모 운영 모범사례까지 한 글에 정리했습니다.
2026-03-09 · 23 분 읽기 #observability#prometheus#monitoring#promql#alertmanagerPrometheus PromQL 고급 쿼리와 Recording Rules 최적화: SLI/SLO 기반 알림 체계 구축 가이드
Prometheus PromQL 고급 쿼리 패턴부터 Recording Rules로 성능 최적화, SLI/SLO 기반 알림 규칙 설계, Alertmanager 라우팅 전략, 그리고 대규모 환경 운영 트러블슈팅까지 다루는 종합 가이드.
2026-03-07 · 39 분 읽기 #observability#prometheus#promql#recording-rules#sliPrometheus PromQL 마스터 가이드
PromQL의 데이터 타입, 셀렉터, 주요 함수(rate/increase/histogramquantile), 알림 규칙, 대시보드 쿼리를 실전 예제로 마스터합니다.
2026-03-03 · 7 분 읽기 #observability#prometheus#promql#monitoring#2026-03Grafana LGTM 스택 완벽 가이드: Loki + Grafana + Tempo + Mimir로 통합 옵저버빌리티 구축
Grafana LGTM(Loki, Grafana, Tempo, Mimir) 스택으로 Logs, Metrics, Traces를 통합 관리하는 옵저버빌리티 플랫폼을 구축한다. Docker Compose 핸즈온, OpenTelemetry 연동, Mermaid 아키텍처 다이어그램 포함.
2026-03-02 · 7 분 읽기 #observability#grafana#loki#tempo#mimirFluent Bit 완벽 가이드: 경량 로그 프로세서의 아키텍처, 설정, Kubernetes 연동까지 총정리
Fluent Bit의 경량 아키텍처와 파이프라인(Input→Parser→Filter→Buffer→Output) 구조부터 Kubernetes DaemonSet 배포, 로그 라우팅, 파서 설정, Elasticsearch·Loki·S3 연동, Fluentd 비교, 성능 튜닝, 프로덕션 운영 가이드까지 총정리한다.
2026-03-01 · 53 분 읽기 #fluent-bit#logging#observability#kubernetes#fluentd프로메테우스란 무엇인가?
What Is Prometheus?
2024-07-27 · 2 분 읽기 #observability#prometheus