태그: #monitoring
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 32 편
네이티브 히스토그램은 stable이 됐는데, 왜 아직 못 켜고 있나
2022년 11월 v2.40에서 실험 기능으로 등장한 Prometheus 네이티브 히스토그램은 2025년 12월 3.8.0에서 stable이 됐고, 2026년 7월 1일 릴리스된 3.13이 이 기능을 stable 상태로 담은 첫 LTS입니다. 기존 3.5 LTS는 2026년 7월 31일에 지원이 끝나므로, LTS 트랙을 타는 조직에게는 지금이 실제 결정 시점입니다. 다만 stable이라는 단
2026-07-16 · 32 분 읽기 #prometheus#observability#native-histograms#metrics#monitoringKeycloak 관측성 — 메트릭, 감사 로그, 이벤트 기반 모니터링
Keycloak의 이벤트 시스템과 메트릭 엔드포인트, EventListener SPI를 활용한 외부 전송, Prometheus와 Grafana 대시보드 구성, OpenTelemetry tracing, 이상 징후 탐지와 알림 룰, 그리고 ISMS/SOC2 감사 컴플라이언스 관점까지 Keycloak 관측성을 종합적으로 다룹니다.
2026-06-12 · 21 분 읽기 #keycloak#observability#monitoring#prometheus#security관측성(Observability) 2026 완벽 가이드 - OpenTelemetry · Datadog · Grafana Stack(LGTM+Beyla) · Honeycomb · Prometheus · Jaeger · eBPF · SLO 심층 분석
2026년 5월 기준 프로덕션 관측성(observability) 스택을 OpenTelemetry 표준 위에서 끝까지 본다. SaaS(Datadog, New Relic, Dynatrace, Splunk, Honeycomb, Coralogix, Logz.io, Chronosphere), 오픈소스(Grafana LGTM+Beyla, Prometheus+Mimir/Cortex/Thanos, Jaeg
2026-05-16 · 29 분 읽기 #observability#opentelemetry#datadog#grafana#honeycomb에러 트래킹 & 모니터링 2026 — Sentry / Bugsnag / Honeybadger / GlitchTip / Highlight / LogRocket / Hyperdx 심층 비교
2026년 에러 트래킹 / 모니터링 전체 지도를 한 번에 — 2024년 Codecov 인수 후 AI 그룹화와 Replay 를 기본으로 끌어올린 사실상의 리더 Sentry, SmartBear 산하에서 엔터프라이즈 컴플라이언스를 챙긴 Bugsnag, 한 사람의 인디 개발자도 부담없이 쓸 수 있는 Honeybadger, Sentry SDK 호환의 셀프호스팅 오픈소스 GlitchTip, 세션 리플레
2026-05-16 · 30 분 읽기 #error-tracking#monitoring#sentry#bugsnag#honeybadger네트워크 & 서비스 옵저버빌리티 2026 완벽 가이드 - eBPF · Cilium Hubble · Pixie · Pyroscope · Grafana Loki + Tempo + Mimir · Netdata · OpenTelemetry 심층 분석
2026년 옵저버빌리티는 메트릭·로그·트레이스·프로파일 4 기둥과 eBPF 자동 계측이 표준이다. Cilium Hubble, Pixie, Pyroscope, Grafana LGTM 스택, Netdata, OpenTelemetry까지 — 무엇을 어떤 비용에 어디서 쓸지 한 번에 정리한다. 한국 NCsoft, Coupang, Naver, Kakao와 일본 Mercari, LINE Yahoo, C
2026-05-16 · 34 분 읽기 #observability#ebpf#cilium-hubble#pixie#pyroscopeOSS 모니터링 스택 2026 깊이 분석 — SigNoz·Coroot·OpenObserve·Sentry·Grafana·Uptrace로 Datadog을 갈아끼우는 법
Datadog 청구서가 한 달에 12만 달러를 넘기는 회사들이 줄줄이 셀프호스트 OSS로 이전하고 있다. SigNoz는 ClickHouse 위에서 OpenTelemetry 네이티브 통합 관측성을, Coroot는 eBPF로 무계측 APM을, OpenObserve는 Rust와 S3로 페타바이트 로그를, Sentry self-hosted는 여전히 에러 추적의 표준이다. Grafana 스택(Loki
2026-05-14 · 34 분 읽기 #observability#monitoring#signoz#coroot#openobserveObservability 완벽 가이드 — Metrics, Logs, Traces, Profiling: Prometheus, OpenTelemetry, Jaeger, Loki, Grafana 모든 것 (2025)
Observability의 모든 것 — Monitoring과 Observability의 차이, 네 가지 기둥(Metrics, Logs, Traces, Profiling), Prometheus의 시계열 DB와 PromQL, OpenTelemetry의 통합 데이터 모델, Jaeger의 span/trace 모델, Loki의 label 인덱싱, Grafana 대시보드, SRE의 SLI/SLO/SLA
2026-04-15 · 43 분 읽기 #observability#monitoring#prometheus#opentelemetry#jaeger시계열 데이터베이스 완전 가이드 2025: TimescaleDB, InfluxDB, Prometheus, ClickHouse 비교
시계열 DB의 모든 것! TimescaleDB(PostgreSQL 확장), InfluxDB, Prometheus, ClickHouse, VictoriaMetrics 비교, 압축(Gorilla), 다운샘플링, 보존 정책, 카디널리티 폭증, IoT/모니터링/금융 사용 사례.
2026-04-15 · 19 분 읽기 #time-series#database#timescaledb#influxdb#prometheusPostgreSQL 프로덕션 운영 완전 가이드 2025: 확장(Extensions), 튜닝, 모니터링, 고가용성
PostgreSQL 프로덕션 운영의 모든 것! 핵심 확장(pgstatstatements/pgvector/PostGIS/TimescaleDB), 성능 튜닝(sharedbuffers/workmem/effectivecachesize), VACUUM/Autovacuum 관리, 모니터링(pgBadger), 고가용성(Patroni), 백업(pgBackRest).
2026-04-15 · 15 분 읽기 #postgresql#database#production#extensions#performance프런트엔드 모니터링·에러 트래킹 2025 — Sentry·Datadog RUM·PostHog·LogRocket·Session Replay·Source Map·AI 이상탐지 완전 가이드
배포한 그 순간, 사용자 화면은 블랙박스가 된다. 2025년 Sentry·Datadog RUM·PostHog·LogRocket·Bugsnag 비교, Source Map 설정, Session Replay의 가치와 윤리, Core Web Vitals 연동, AI 기반 이상 탐지, 그리고 Privacy-safe 로깅까지 프런트엔드 모니터링의 모든 것.
2026-04-15 · 22 분 읽기 #monitoring#error-tracking#sentry#datadog#posthogMLOps & AI 모델 배포 완전 가이드 — 학습부터 서빙, 모니터링까지
AI 모델을 학습하고 배포하고 운영하는 전 과정. MLflow, Kubeflow, 모델 서빙, A/B 테스트, 드리프트 감지까지 MLOps의 모든 것.
2026-04-13 · 25 분 읽기 #mlops#ai#deployment#model-serving#monitoringWebSocket 실시간 통신 & 옵저버빌리티(모니터링) 완전 가이드
WebSocket/SSE/gRPC 실시간 통신 원리부터 OpenTelemetry, Prometheus, Grafana를 활용한 옵저버빌리티 구축까지.
2026-04-12 · 18 분 읽기 #devops#websocket#realtime#observability#monitoringObservability & 모니터링 완전 가이드 2025: 로깅, 메트릭, 트레이싱, 알림 전략
Observability의 모든 것! Three Pillars(로그/메트릭/트레이스), OpenTelemetry, Prometheus+Grafana, ELK Stack, 분산 트레이싱(Jaeger/Tempo), 알림 전략(PagerDuty/OpsGenie), SLO/SLI/SLA, 비용 최적화.
2026-03-25 · 25 분 읽기 #observability#monitoring#logging#distributed-tracing#metrics관측성(Observability) 완전 가이드 2025: Prometheus, Grafana, OpenTelemetry로 시스템을 투명하게
관측성의 3가지 축(메트릭/로그/트레이스)을 완전 정복! Prometheus 쿼리(PromQL), Grafana 대시보드, OpenTelemetry 계측, Jaeger 분산 추적, ELK/Loki 로깅, 알림 전략, SLI/SLO/SLA, 온콜 문화까지.
2026-03-23 · 25 분 읽기 #observability#monitoring#prometheus#grafana#opentelemetryAWS SysOps Administrator Associate (SOA-C02) 실전 모의고사 65문제
AWS SysOps Administrator Associate(SOA-C02) 시험 대비 실전 모의고사 65문제. 모니터링, 신뢰성, 배포 자동화, 보안, 네트워킹, 비용 최적화 전 도메인 완벽 커버.
2026-03-17 · 70 분 읽기 #aws#soa-c02#sysops#aws-certification#monitoringAWS DevOps Engineer Professional (DOP-C02) 실전 모의고사 75문제
AWS Certified DevOps Engineer Professional DOP-C02 시험 대비 실전 모의고사 75문제. CodePipeline, CloudFormation, Systems Manager, X-Ray, Route 53, Aurora Global 등 복잡한 시나리오 완벽 정리.
2026-03-17 · 82 분 읽기 #aws#dop-c02#devops#aws-certification#ci-cdeBPF와 OpenTelemetry로 진화하는 관찰가능성(Observability) 2026
eBPF 기술과 OpenTelemetry 표준화의 결합으로, 2026년 관찰가능성은 근본적으로 변화하고 있습니다. 제로 계측(zero-instrumentation) 트레이싱, AI 기반 근본원인 분석, 비용 최적화된 관찰가능성 스택이 표준이 되어, 엔지니어들은 이제 "왜"의 질문에 즉시 답할 수 있습니다.
2026-03-16 · 15 분 읽기 #ebpf#observability#opentelemetry#cilium#distributed-systemsSLI/SLO/Error Budget 기반 신뢰성 엔지니어링 실전 가이드
SLI/SLO/Error Budget을 활용한 신뢰성 엔지니어링의 이론과 실전을 다룹니다. SLI 지표 선정, SLO 수치 설정, Error Budget 정책, Burn Rate 알럿, Prometheus 기반 구현까지 프로덕션 서비스의 신뢰성 관리 전체 파이프라인을 코드와 함께 구축합니다.
2026-03-13 · 21 분 읽기 #observability#sli#slo#error-budget#sreLLMOps 플랫폼 구축 가이드: 모델 배포, 모니터링, A/B 테스트 실전 아키텍처
LLMOps 플랫폼의 설계와 구현을 다룹니다. vLLM/TGI 기반 모델 서빙, 토큰 사용량/레이턴시/품질 모니터링, 프롬프트 버전 관리, A/B 테스트 프레임워크, 가드레일 통합까지 프로덕션 LLM 운영의 전체 라이프사이클을 코드와 함께 구축합니다.
2026-03-13 · 23 분 읽기 #ai-platform#llmops#model-serving#monitoring#ab-testingOpenTelemetry 분산 트레이싱 실전 가이드: 계측·수집·분석 파이프라인 구축과 운영
OpenTelemetry 아키텍처(SDK, API, Collector, Exporters), 트레이스 모델(Span, SpanContext, TraceID, SpanID, Baggage), Python·Node.js·Go 수동 계측, 자동 계측, Collector 파이프라인(receivers/processors/exporters), 샘플링 전략(head-based, tail-based), 백
2026-03-11 · 18 분 읽기 #observability#opentelemetry#distributed-tracing#instrumentation#monitoring