태그: #logging
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 9 편
로그를 검색 가능하게, 그리고 파산하지 않게 — 구조화, 매핑 폭발, 보존, 그리고 진짜 비용
로그 비용이 컴퓨트 비용을 넘어서는 시점은 대부분의 조직에 옵니다. 그 시점을 늦추는 것은 압축률이 아니라 무엇을 필드로 만들 것인가에 대한 결정입니다. 구조화 로그의 필드 설계부터 OpenSearch 매핑 폭발이 실제로 클러스터를 죽이는 경로, 인덱스 템플릿과 ISM 으로 수명주기를 통제하는 방법, 원칙 있는 샘플링과 보존 계층을 다룹니다. 마지막으로 로그로 메트릭을 흉내 낼 때 드는 비용
2026-08-02 · 24 분 읽기 #observability#logging#opensearch#elasticsearch#cost구조화 로깅 설계 — 장애가 났을 때 실제로 도움이 되는 로그 만들기
장애 한복판에서 로그를 grep하다 포기해 본 적이 있다면 로그 설계가 잘못된 것입니다. 사람이 읽는 로그와 기계가 읽는 로그를 분리하고, 모든 라인에 반드시 들어가야 할 필드를 정하고, 로그 레벨을 판단하는 단 하나의 기준을 세우는 방법을 다룹니다. W3C traceparent로 서비스 경계 너머까지 요청을 따라가는 법, 개인정보와 시크릿을 걸러내는 마스킹 설정, 이야기가 끊기지 않는 요청
2026-07-26 · 20 분 읽기 #observability#logging#structured-logging#opentelemetry#incident-response관측 가능성 완전 정복: 로그·트레이싱·LLM 모니터링
로그·메트릭·트레이스라는 세 기둥부터 이들이 traceid로 어떻게 엮이는지, Loki와 OpenSearch의 로그 전략 차이, OpenTelemetry를 중심으로 한 분산 트레이싱(Jaeger·Tempo), 그리고 Langfuse로 대표되는 LLM 관측 가능성까지. 실무에서 스택을 어떻게 짜고 무엇을 골라야 하는지 하나씩 대조하며 정리합니다.
2026-07-03 · 27 분 읽기 #observability#opentelemetry#tracing#logging#llm로그와 스택트레이스를 탐정처럼 읽기
스택트레이스는 사건 현장이고, 로그는 목격자 진술입니다. 스택트레이스를 위에서 아래로 읽는 법(맨 위는 터진 곳, 맨 아래는 발단), "caused by" 사슬 추적, 구조화·JSON 로깅, 상관관계 ID와 traceid, grep·jq·ripgrep으로 로그 파헤치기, 로그 레벨과 샘플링까지. 로그와 트레이스를 증거처럼 다루는 탐정의 기술.
2026-06-28 · 22 분 읽기 #logging#debugging#stack-trace#observabilityObservability & 모니터링 완전 가이드 2025: 로깅, 메트릭, 트레이싱, 알림 전략
Observability의 모든 것! Three Pillars(로그/메트릭/트레이스), OpenTelemetry, Prometheus+Grafana, ELK Stack, 분산 트레이싱(Jaeger/Tempo), 알림 전략(PagerDuty/OpsGenie), SLO/SLI/SLA, 비용 최적화.
2026-03-25 · 25 분 읽기 #observability#monitoring#logging#distributed-tracing#metrics관측성(Observability) 완전 가이드 2025: Prometheus, Grafana, OpenTelemetry로 시스템을 투명하게
관측성의 3가지 축(메트릭/로그/트레이스)을 완전 정복! Prometheus 쿼리(PromQL), Grafana 대시보드, OpenTelemetry 계측, Jaeger 분산 추적, ELK/Loki 로깅, 알림 전략, SLI/SLO/SLA, 온콜 문화까지.
2026-03-23 · 25 분 읽기 #observability#monitoring#prometheus#grafana#opentelemetryGrafana LGTM 스택 완벽 가이드: Loki + Grafana + Tempo + Mimir로 통합 옵저버빌리티 구축
Grafana LGTM(Loki, Grafana, Tempo, Mimir) 스택으로 Logs, Metrics, Traces를 통합 관리하는 옵저버빌리티 플랫폼을 구축한다. Docker Compose 핸즈온, OpenTelemetry 연동, Mermaid 아키텍처 다이어그램 포함.
2026-03-02 · 7 분 읽기 #observability#grafana#loki#tempo#mimirGrafana + Loki + Promtail 로그 파이프라인 구축 가이드
Grafana, Loki, Promtail을 활용한 경량 로그 수집·저장·시각화 파이프라인을 Docker Compose로 구축하고, 라벨 기반 쿼리와 알림까지 설정하는 실전 가이드
2026-03-02 · 12 분 읽기 #grafana#loki#promtail#observability#loggingFluent Bit 완벽 가이드: 경량 로그 프로세서의 아키텍처, 설정, Kubernetes 연동까지 총정리
Fluent Bit의 경량 아키텍처와 파이프라인(Input→Parser→Filter→Buffer→Output) 구조부터 Kubernetes DaemonSet 배포, 로그 라우팅, 파서 설정, Elasticsearch·Loki·S3 연동, Fluentd 비교, 성능 튜닝, 프로덕션 운영 가이드까지 총정리한다.
2026-03-01 · 53 분 읽기 #fluent-bit#logging#observability#kubernetes#fluentd