로그 파이프라인 설계 · 인덱스 설계 · 퀴즈
인덱스 설계 확인
문항 6개. 정답과 해설은 풀어 본 뒤에 보여 드립니다.
로그 인덱스를 날짜로 나누는 가장 큰 이유는?
- 날짜별로 나누면 검색이 언제나 빨라져서
- 인덱스를 나눠야 복제본을 만들 수 있어서
- 인덱스가 여러 개면 전체 샤드 수가 줄어서
- 인덱스 통째로 지우는 것이 문서 삭제보다 훨씬 싸서
매핑 폭발이 클러스터를 느리게 만드는 경로는?
- 필드마다 파일이 생겨 디스크가 금세 차서
- 클러스터 상태가 커지고 그것이 모든 노드에 복제돼서
- 필드가 늘수록 색인 CPU 가 비례해 늘어서
- 노드 사이 네트워크 대역폭을 다 써서
로그 인덱스에 `dynamic: strict` 가 위험한 이유는?
- 예상 못 한 필드 하나에 문서가 통째로 거부되어 로그가 유실돼서
- 매핑을 검사하느라 색인 속도가 크게 떨어져서
- 거부된 문서를 따로 쌓아 두느라 디스크를 더 써서
- 매핑이 고정되어 복제본을 늘릴 수 없어서
파드 이름으로 집계(terms aggregation)를 하려면 필드 타입은?
- text
- wildcard
- keyword
- match_only_text
샤드 크기의 경험칙으로 적절한 것은?
- 1GB 이하
- 100GB 이상
- 클수록 좋다
- 10~50GB
로그에 트레이스 ID 를 넣는 이유는?
- 같은 값이 반복되어 압축률이 좋아져서
- 느린 요청 하나가 남긴 로그를 한 번에 모을 수 있어서
- ID 로 묶이면 인덱스 크기가 줄어서
- 사용자 정보를 대신해 개인정보를 가려서