태그: #observability
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 118 편
Envoy Proxy Deep Dive — xDS, Filter Chain, Service Mesh, Hot Restart 내부 완전 정복 (2025)
Istio, Consul Connect, AWS App Mesh, Google Cloud Service Mesh — 현대 서비스 메시의 거의 모든 구현이 Envoy를 데이터 플레인으로 씁니다. 이 글은 Envoy의 내부를 처음부터 해부합니다. Listener/Filter/Cluster 아키텍처, xDS 디스커버리 프로토콜(LDS/RDS/CDS/EDS), HTTP 필터 체인과 라우팅, Clus
2026-04-15 · 38 분 읽기 #envoy#proxy#service-mesh#istio#xdseBPF 완전 가이드 2025: 커널 프로그래밍, Observability, 네트워킹, 보안의 혁명
eBPF의 모든 것! Linux 커널 안전 프로그래밍, BCC vs libbpf vs bpftrace, Cilium(네트워킹), Falco(보안), Pixie(observability), Tetragon, CO-RE, 실전 트레이싱, 성능 최적화, 프로덕션 사례.
2026-04-14 · 21 분 읽기 #ebpf#kernel#observability#networking#securityAPI Gateway 완전 가이드 2025: Kong, Envoy, AWS API Gateway, 인증/레이트리밋/모니터링
API Gateway의 모든 것! Kong vs Envoy vs AWS API Gateway vs Traefik 비교, 라우팅/인증(OAuth2/JWT/API Key), 레이트 리밋(Token Bucket/Sliding Window), 요청 변환, 캐싱, 모니터링, 카나리 배포, GraphQL Gateway, API 버저닝 전략.
2026-04-14 · 37 분 읽기 #api-gateway#kong#envoy#aws-api-gateway#rate-limitingService Mesh 완전 가이드 2025: Istio vs Linkerd, mTLS, 트래픽 관리, Observability
Service Mesh의 모든 것! Istio vs Linkerd 비교, Envoy 사이드카 프록시, mTLS 자동 암호화, 트래픽 관리(카나리/미러링/서킷브레이커), Observability(메트릭/트레이싱/로깅), Gateway API, Ambient Mesh, 프로덕션 운영 베스트 프랙티스.
2026-04-13 · 31 분 읽기 #service-mesh#istio#linkerd#mtls#traffic-managementWebSocket 실시간 통신 & 옵저버빌리티(모니터링) 완전 가이드
WebSocket/SSE/gRPC 실시간 통신 원리부터 OpenTelemetry, Prometheus, Grafana를 활용한 옵저버빌리티 구축까지.
2026-04-12 · 18 분 읽기 #devops#websocket#realtime#observability#monitoringLlamaIndex Workflows 실전 가이드: 이벤트 기반 에이전트와 RAG를 프로덕션으로 옮기는 법
LlamaIndex Workflows를 이벤트 기반 설계, observability, human-in-the-loop, LlamaDeploy 관점에서 정리한 실전 가이드입니다. 언제 쓰고 어떻게 운영에 올릴지까지 함께 다룹니다.
2026-04-12 · 11 분 읽기 #llamaindex#workflows#agent-workflow#rag#observabilityAmazon Bedrock AgentCore Practical Guide: How to Build Secure Production Agents in 2026
A practical guide to Amazon Bedrock AgentCore for teams that need secure, production-ready agents, with clear coverage of Runtime, Memory, Gateway, observability, and rollout checks.
2026-04-12 · 6 분 읽기 #aws#bedrock#agentcore#ai-agent#mcpPydanticAI 실전 가이드: 2026년 Python 팀이 프로덕션 에이전트에 채택하는 이유
Python 중심 에이전트 시스템, 모델 유연성, 내구성 있는 워크플로, 관측 가능성, 평가 체계가 필요한 팀을 위한 PydanticAI 실전 가이드입니다.
2026-04-12 · 11 분 읽기 #pydantic#pydantic-ai#python#ai-agent#mcpCloudflare Agents와 Durable Objects로 AI 앱을 만드는 실전 가이드
Cloudflare Agents와 Durable Objects를 AI 앱에 어떻게 연결하는지, 왜 상태와 장기 실행이 중요한지, stateless serverless와 무엇이 다른지, 그리고 실제 롤아웃 체크리스트까지 한 번에 정리한 2026년 실전 가이드입니다.
2026-04-12 · 15 분 읽기 #cloudflare#cloudflare-agents#durable-objects#ai-agent#mcpGoogle Agent Development Kit 실전 가이드: 엔터프라이즈 에이전트에 ADK가 맞는 이유
Google Agent Development Kit를 평가하는 팀을 위한 실전 가이드로, 컨텍스트 관리, callbacks, 멀티에이전트 구성, 롤아웃 판단 기준을 중심으로 정리한다.
2026-04-12 · 10 분 읽기 #google-adk#agent-development-kit#ai-agent#multi-agent#session-stateMastra 실전 가이드: 2026년 TypeScript 팀이 프로덕션 AI 에이전트에 채택하는 이유
오픈소스 TypeScript 스택 안에서 에이전트, 메모리, 워크플로, 관측 가능성, 평가, 프로덕션 배포를 함께 다뤄야 하는 팀을 위한 Mastra 실전 가이드입니다.
2026-04-12 · 12 분 읽기 #mastra#typescript#ai-agent#mcp#memoryOpenAI, Azure, AWS 엔터프라이즈 에이전트 관측성과 평가 비교 가이드
OpenAI, Azure, AWS의 에이전트 관측성, 평가, 대시보드, OpenTelemetry 연동을 비교하고 플랫폼, 제품, 인프라 팀이 롤아웃 결정을 내리는 방법을 정리한 실무 가이드입니다.
2026-04-12 · 6 분 읽기 #openai#azure#aws#observability#evaluationCloudflare AI Gateway 실전 가이드: AI 트래픽을 관찰하고 제어하는 가장 빠른 방법
Cloudflare AI Gateway를 왜 쓰는지, 어떤 제어가 가능한지, Dynamic Routing과 자동 재시도를 어떻게 함께 써야 하는지 2026년 4월 기준으로 실무적으로 정리한다.
2026-04-12 · 11 분 읽기 #ai-platform#cloudflare#ai-gateway#observability#cachingAzure AI Foundry Agent Service 실전 가이드: 2026년 엔터프라이즈 배포 판단 기준
Azure AI Foundry Agent Service를 엔터프라이즈 관점에서 정리한 실전 가이드로, 왜 관리형 에이전트가 필요한지, 도구 카탈로그와 원격 MCP 서버를 어떻게 활용하는지, 그리고 tracing, evaluation, governance, private networking 기준으로 어떻게 배포를 판단할지 설명한다.
2026-04-12 · 9 분 읽기 #azure#azure-ai-foundry#agent-service#ai-agent#mcpObservability & 모니터링 완전 가이드 2025: 로깅, 메트릭, 트레이싱, 알림 전략
Observability의 모든 것! Three Pillars(로그/메트릭/트레이스), OpenTelemetry, Prometheus+Grafana, ELK Stack, 분산 트레이싱(Jaeger/Tempo), 알림 전략(PagerDuty/OpsGenie), SLO/SLI/SLA, 비용 최적화.
2026-03-25 · 25 분 읽기 #observability#monitoring#logging#distributed-tracing#metricsElasticsearch 완전 가이드 2025: 검색 엔진부터 로그 분석, 벡터 검색까지
Elasticsearch의 모든 것! 역색인 원리, 매핑/분석기, 쿼리 DSL, 집계, ELK 스택, 벡터 검색(kNN), 클러스터 운영, 성능 최적화, 면접 질문까지.
2026-03-24 · 29 분 읽기 #elasticsearch#search#elk-stack#kibana#logstash관측성(Observability) 완전 가이드 2025: Prometheus, Grafana, OpenTelemetry로 시스템을 투명하게
관측성의 3가지 축(메트릭/로그/트레이스)을 완전 정복! Prometheus 쿼리(PromQL), Grafana 대시보드, OpenTelemetry 계측, Jaeger 분산 추적, ELK/Loki 로깅, 알림 전략, SLI/SLO/SLA, 온콜 문화까지.
2026-03-23 · 25 분 읽기 #observability#monitoring#prometheus#grafana#opentelemetryPrometheus TSDB 내부 구조: WAL, Chunks, Blocks, Compaction
Prometheus TSDB의 내부 구조를 소스코드 레벨에서 분석합니다. WAL 세그먼트 구조, Head Block의 memSeries와 청크 인코딩(XOR, delta-of-delta), 블록 구조, 컴팩션 알고리즘, 인덱스의 posting list까지 깊이 살펴봅니다.
2026-03-20 · 17 분 읽기 #prometheus#observability#open-source-internalsPrometheus 아키텍처 내부 분석: 소스코드 레벨 딥다이브
Prometheus 서버의 내부 아키텍처를 소스코드 레벨에서 분석합니다. Scrape Manager, TSDB, Rule Manager, Notifier, Web UI 등 주요 컴포넌트의 goroutine 모델과 생명주기 관리, 설정 리로드 메커니즘을 깊이 살펴봅니다.
2026-03-20 · 15 분 읽기 #prometheus#observability#open-source-internalsPromQL 엔진 내부 구조: 파서부터 실행 엔진까지
PromQL 엔진의 내부 구조를 소스코드 레벨에서 분석합니다. 렉서와 파서, AST 구조, 쿼리 평가 엔진의 instant query와 range query 처리, step 평가, lookback delta, 서브쿼리 구현, 메모리 관리까지 깊이 살펴봅니다.
2026-03-20 · 15 분 읽기 #prometheus#observability#open-source-internals