태그: #data-modeling
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 4 편
Langfuse 트레이싱 데이터 모델 — trace, observation, score가 한 번의 실행을 담는 방식
Langfuse 화면을 먼저 보면 무엇을 보고 있는지 알 수 없습니다. 이 글은 Langfuse가 수집하는 데이터의 형태부터 정리합니다. trace가 무엇을 묶고 observation이 span·generation·event로 갈리는 기준은 무엇인지, session과 user가 trace 위에 어떤 층으로 얹히는지, score가 어디에 붙는지를 공식 문서 기준으로 확인합니다. RAG 한 번의
2026-08-14 · 15 분 읽기 #observability#langfuse#llm-tracing#data-modeling#opentelemetry관측 데이터를 ClickHouse에 넣는다는 것 — 스키마, 롤업, TTL, 그리고 역할 분담
트레이스와 로그가 하루 수 TB로 늘어나면 검색 엔진이나 시계열 DB 하나로 버티기 어려워집니다. ClickHouse 가 관측 데이터에 잘 맞는 이유를 컬럼 저장과 압축, 정렬 키의 관점에서 정리하고 트레이스와 로그 테이블을 실제 DDL 로 설계합니다. 속성을 Map 으로 둘 것인지 JSON 타입으로 둘 것인지의 판단 기준, 머티리얼라이즈드 뷰로 롤업을 만드는 방법, 파티셔닝과 TTL 로 비
2026-08-02 · 25 분 읽기 #observability#clickhouse#opentelemetry#data-modeling#costNoSQL·이기종 데이터 마이그레이션 — RDB와 MongoDB와 다양한 스토어 사이에서
관계형과 문서형은 데이터 모델 자체가 다릅니다. RDB에서 문서로, 문서에서 RDB로 옮길 때 무엇을 다시 설계해야 하는지, 스트랭글러와 이중 쓰기와 CDC로 어떻게 무중단 이전을 하는지, 그리고 일관성을 어디까지 양보할지 실전 관점에서 정리합니다.
2026-06-16 · 30 분 읽기 #database#migration#nosql#mongodb#cdcHBase 데이터 모델링 플레이북: 핫스팟 회피와 성능 안정화
HBase RowKey 설계 패턴, 핫스팟 탐지와 회피 전략, Region 분산 최적화 등 대규모 HBase 운영에서 성능을 안정화하기 위한 실전 플레이북.
2026-03-08 · 38 분 읽기 #hbase#nosql#data-modeling#hotspot#database