태그: #opentelemetry
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 40 편
Langfuse SDK 계측 — 무엇이 자동으로 잡히고 무엇을 손으로 넣나
트레이스를 만드는 일은 SDK를 설치하는 일이 아니라 경계를 긋는 일입니다. 이 글은 Langfuse 파이썬 SDK v4를 기준으로 데코레이터, 컨텍스트 매니저, 수동 생성 세 가지 계측 방식이 각각 무엇을 다르게 하는지 정리하고, 속성을 하위로 흘려보내는 propagateattributes가 왜 필요한지, OpenAI와 LangChain 같은 프레임워크 통합이 자동으로 잡아 주는 범위가 어
2026-08-14 · 15 분 읽기 #observability#langfuse#llm-tracing#instrumentation#opentelemetryLangfuse 트레이싱 데이터 모델 — trace, observation, score가 한 번의 실행을 담는 방식
Langfuse 화면을 먼저 보면 무엇을 보고 있는지 알 수 없습니다. 이 글은 Langfuse가 수집하는 데이터의 형태부터 정리합니다. trace가 무엇을 묶고 observation이 span·generation·event로 갈리는 기준은 무엇인지, session과 user가 trace 위에 어떤 층으로 얹히는지, score가 어디에 붙는지를 공식 문서 기준으로 확인합니다. RAG 한 번의
2026-08-14 · 15 분 읽기 #observability#langfuse#llm-tracing#data-modeling#opentelemetry지금 주목받는 오픈소스 (4) 관측 가능성과 보안
관측 데이터는 양이 곧 비용이고, 보안 도구는 파이프라인에 들어가지 못하면 쓰이지 않습니다. 계측 표준, 저장 엔진, eBPF 기반 런타임 감시, 공급망 검증까지 실제로 자리를 잡은 오픈소스 12개를 스타 순위가 아니라 담당하는 층별로 묶어 소개합니다. 무엇을 대체하는지, 성숙도가 어느 정도인지, 언제 쓰면 안 되는지를 함께 적었습니다. 저장소 경로와 라이선스, 스타 수, 최근 푸시는 202
2026-08-12 · 9 분 읽기 #open-source#observability#security#opentelemetry#ebpf관측 데이터를 ClickHouse에 넣는다는 것 — 스키마, 롤업, TTL, 그리고 역할 분담
트레이스와 로그가 하루 수 TB로 늘어나면 검색 엔진이나 시계열 DB 하나로 버티기 어려워집니다. ClickHouse 가 관측 데이터에 잘 맞는 이유를 컬럼 저장과 압축, 정렬 키의 관점에서 정리하고 트레이스와 로그 테이블을 실제 DDL 로 설계합니다. 속성을 Map 으로 둘 것인지 JSON 타입으로 둘 것인지의 판단 기준, 머티리얼라이즈드 뷰로 롤업을 만드는 방법, 파티셔닝과 TTL 로 비
2026-08-02 · 25 분 읽기 #observability#clickhouse#opentelemetry#data-modeling#cost애플리케이션에 OpenTelemetry 붙이기 — 자동 계측에서 수동 스팬까지, 그리고 컬렉터를 두는 이유
계측은 SDK를 설치하는 일이 아니라 순서를 지키는 일입니다. 자동 계측으로 하루 만에 골격을 세우고, 리소스 속성을 먼저 확정한 뒤, self time이 큰 구간에만 수동 스팬을 넣는 순서를 실제 서비스 하나를 끝까지 계측하며 보여줍니다. 컨텍스트 전파가 끊기는 네 지점인 스레드풀, 메시지 큐, 백그라운드 작업, 헤더를 지우는 프록시를 각각 재현하고 고칩니다. 마지막으로 컬렉터를 앱과 백엔
2026-08-02 · 27 분 읽기 #observability#opentelemetry#instrumentation#otel-collector#tracing구조화 로깅 설계 — 장애가 났을 때 실제로 도움이 되는 로그 만들기
장애 한복판에서 로그를 grep하다 포기해 본 적이 있다면 로그 설계가 잘못된 것입니다. 사람이 읽는 로그와 기계가 읽는 로그를 분리하고, 모든 라인에 반드시 들어가야 할 필드를 정하고, 로그 레벨을 판단하는 단 하나의 기준을 세우는 방법을 다룹니다. W3C traceparent로 서비스 경계 너머까지 요청을 따라가는 법, 개인정보와 시크릿을 걸러내는 마스킹 설정, 이야기가 끊기지 않는 요청
2026-07-26 · 20 분 읽기 #observability#logging#structured-logging#opentelemetry#incident-response분산 트레이싱이 실제로 답하는 질문 — 스팬, 샘플링, 그리고 어디서 시간이 갔는가
"느리다"는 신고는 들어오는데 열 개 서비스 중 어디가 범인인지 모를 때 필요한 것이 트레이싱입니다. 트레이스와 스팬, 컨텍스트 전파의 구조부터 시작해 로그와 메트릭으로는 원리적으로 답할 수 없는 질문이 무엇인지 정리합니다. 자동 계측이 커버하는 범위와 수동 스팬을 반드시 넣어야 하는 지점, 헤드 샘플링이 왜 필요한 트레이스를 우선적으로 버리는지, 테일 샘플링이 그것을 어떻게 풀고 대신 무엇
2026-07-26 · 25 분 읽기 #observability#distributed-tracing#opentelemetry#tail-sampling#performanceOTel의 Kubernetes 속성이 stable이 됐다 — k8sattributes 기본값이 뒤집히기 전에 할 일
OpenTelemetry의 Kubernetes 시맨틱 컨벤션이 2026년 6월 12일 semconv v1.42.0에서 stable로 승급했습니다. 그런데 Collector의 k8sattributes 프로세서는 아직 기본값이 옛 스키마(v0)라, 대부분의 사람은 아무 일도 겪지 않았습니다. 문제는 이게 영구적이지 않다는 것입니다 — Collector RFC가 정한 롤아웃대로라면 피처 게이트가
2026-07-16 · 22 분 읽기 #opentelemetry#observability#kubernetes#semantic-conventions#telemetry-pipeline관측 가능성 완전 정복: 로그·트레이싱·LLM 모니터링
로그·메트릭·트레이스라는 세 기둥부터 이들이 traceid로 어떻게 엮이는지, Loki와 OpenSearch의 로그 전략 차이, OpenTelemetry를 중심으로 한 분산 트레이싱(Jaeger·Tempo), 그리고 Langfuse로 대표되는 LLM 관측 가능성까지. 실무에서 스택을 어떻게 짜고 무엇을 골라야 하는지 하나씩 대조하며 정리합니다.
2026-07-03 · 27 분 읽기 #observability#opentelemetry#tracing#logging#llm관측성(Observability) 2026 완벽 가이드 - OpenTelemetry · Datadog · Grafana Stack(LGTM+Beyla) · Honeycomb · Prometheus · Jaeger · eBPF · SLO 심층 분석
2026년 5월 기준 프로덕션 관측성(observability) 스택을 OpenTelemetry 표준 위에서 끝까지 본다. SaaS(Datadog, New Relic, Dynatrace, Splunk, Honeycomb, Coralogix, Logz.io, Chronosphere), 오픈소스(Grafana LGTM+Beyla, Prometheus+Mimir/Cortex/Thanos, Jaeg
2026-05-16 · 29 분 읽기 #observability#opentelemetry#datadog#grafana#honeycomb에러 트래킹 & 모니터링 2026 — Sentry / Bugsnag / Honeybadger / GlitchTip / Highlight / LogRocket / Hyperdx 심층 비교
2026년 에러 트래킹 / 모니터링 전체 지도를 한 번에 — 2024년 Codecov 인수 후 AI 그룹화와 Replay 를 기본으로 끌어올린 사실상의 리더 Sentry, SmartBear 산하에서 엔터프라이즈 컴플라이언스를 챙긴 Bugsnag, 한 사람의 인디 개발자도 부담없이 쓸 수 있는 Honeybadger, Sentry SDK 호환의 셀프호스팅 오픈소스 GlitchTip, 세션 리플레
2026-05-16 · 30 분 읽기 #error-tracking#monitoring#sentry#bugsnag#honeybadger네트워크 & 서비스 옵저버빌리티 2026 완벽 가이드 - eBPF · Cilium Hubble · Pixie · Pyroscope · Grafana Loki + Tempo + Mimir · Netdata · OpenTelemetry 심층 분석
2026년 옵저버빌리티는 메트릭·로그·트레이스·프로파일 4 기둥과 eBPF 자동 계측이 표준이다. Cilium Hubble, Pixie, Pyroscope, Grafana LGTM 스택, Netdata, OpenTelemetry까지 — 무엇을 어떤 비용에 어디서 쓸지 한 번에 정리한다. 한국 NCsoft, Coupang, Naver, Kakao와 일본 Mercari, LINE Yahoo, C
2026-05-16 · 34 분 읽기 #observability#ebpf#cilium-hubble#pixie#pyroscopeKubestronaut 로드맵 2026 완벽 가이드 - CKA · CKAD · CKS · KCNA · KCSA와 CNCF 자격증 사다리(Prometheus · Istio · Cilium · OpenTelemetry · Argo) 심층 분석
2026년 5월 기준 Kubestronaut 프로그램과 CNCF 자격증 사다리를 끝까지 본다. 5종 핵심 시험(CKA, CKAD, CKS, KCNA, KCSA)의 출제 범위, 시험 형식, 합격선, 합격률, Killer Shell 모의시험, KodeKloud/A Cloud Guru/Linux Foundation 트레이닝, Golden Kubestronaut 코스, 어소시에이트 사다리(PCA,
2026-05-16 · 30 분 읽기 #kubestronaut#cncf#kubernetes#cka#ckad분산 추적 & OpenTelemetry 2026 — OTel / Jaeger / Tempo / Zipkin / Honeycomb / Lightstep / SigNoz / SkyWalking / Datadog APM 심층 비교
2026년 분산 추적은 OpenTelemetry로 수렴했다. OTel 사양과 Collector, W3C Trace Context와 B3 Propagation, Jaeger/Tempo/Zipkin 같은 OSS 백엔드, Honeycomb과 SigNoz 같은 observability 2.0 진영, Lightstep과 Datadog/New Relic/Dynatrace 같은 APM 거인, 그리고 Pi
2026-05-16 · 36 분 읽기 #observability#distributed-tracing#opentelemetry#otelcol#jaegereBPF 관찰성 2026 — Pixie / Parca / Cilium Hubble / Tetragon / Beyla / Coroot / Falco 심층 가이드
2026년 시점의 eBPF 생태계를 한 번에 정리한다. Pixie, Parca, Cilium Hubble, Tetragon, BCC/bpftrace, OpenTelemetry eBPF Collector, Grafana Beyla, Coroot, Inspektor Gadget, Kepler, Falco 등 주요 도구를 비교하고, CO-RE 혁명과 Windows/macOS 이식까지 다룬다.
2026-05-15 · 39 분 읽기 #ebpf#observability#pixie#parca#ciliumOpenTelemetry 2026 심층 — OTLP·시맨틱 컨벤션·Collector 파이프라인·자동 계측의 표준화 전쟁이 끝난 자리
OpenTelemetry는 더 이상 '경쟁하는 옵션 중 하나'가 아니다. 2026년 5월 기준, OTLP는 모든 주요 옵저버빌리티 벤더가 받는 단일 프로토콜이 됐고, HTTP·관계형 DB·메시징 시맨틱 컨벤션 v1은 stable로 잠겼다. 로그가 GA로 들어왔고, Profiles는 네 번째 시그널로 자리잡아 가는 중이다. Beyla·Coroot가 끌고 온 eBPF 자동 계측은 'SDK 없이
2026-05-14 · 39 분 읽기 #opentelemetry#observability#traces#metrics#logsOSS 모니터링 스택 2026 깊이 분석 — SigNoz·Coroot·OpenObserve·Sentry·Grafana·Uptrace로 Datadog을 갈아끼우는 법
Datadog 청구서가 한 달에 12만 달러를 넘기는 회사들이 줄줄이 셀프호스트 OSS로 이전하고 있다. SigNoz는 ClickHouse 위에서 OpenTelemetry 네이티브 통합 관측성을, Coroot는 eBPF로 무계측 APM을, OpenObserve는 Rust와 S3로 페타바이트 로그를, Sentry self-hosted는 여전히 에러 추적의 표준이다. Grafana 스택(Loki
2026-05-14 · 34 분 읽기 #observability#monitoring#signoz#coroot#openobserveObservability 완벽 가이드 — Metrics, Logs, Traces, Profiling: Prometheus, OpenTelemetry, Jaeger, Loki, Grafana 모든 것 (2025)
Observability의 모든 것 — Monitoring과 Observability의 차이, 네 가지 기둥(Metrics, Logs, Traces, Profiling), Prometheus의 시계열 DB와 PromQL, OpenTelemetry의 통합 데이터 모델, Jaeger의 span/trace 모델, Loki의 label 인덱싱, Grafana 대시보드, SRE의 SLI/SLO/SLA
2026-04-15 · 43 분 읽기 #observability#monitoring#prometheus#opentelemetry#jaegerOpenTelemetry 완전 해부 — Trace/Metric/Log/Profile 4기둥, Collector, 샘플링, OTLP까지
Jaeger 대시보드의 예쁜 스팬 뒤에 있는 진실. OpenTelemetry의 탄생 배경부터 Span/TraceContext 전파 메커니즘, Collector 파이프라인, Head vs Tail 샘플링, eBPF auto-instrumentation, 그리고 Profile이 네 번째 기둥이 된 이야기까지.
2026-04-15 · 21 분 읽기 #opentelemetry#observability#distributed-tracing#metrics#logsObservability 완전 가이드 — Metric·Log·Trace·OpenTelemetry·eBPF·SLO (Season 2 Ep 9, 2025)
"관측할 수 없으면 운영할 수 없다." Observability는 로그 수집·모니터링의 상위 개념으로, 알려지지 않은 문제(unknown unknowns)를 시스템 상태만으로 추론할 수 있게 하는 능력이다. 이 글은 Metric·Log·Trace 3축, Profile을 더한 4축, OpenTelemetry 표준의 진짜 가치, eBPF 커널 수준 관측, SLO·SLI·Error Budget 실
2026-04-15 · 16 분 읽기 #observability#opentelemetry#prometheus#grafana#loki