LabHub

로그 파이프라인 설계 · 인덱스 설계 · 퀴즈

인덱스 설계 확인

LabHub 에서 이어서 보기

문항 6개. 정답과 해설은 풀어 본 뒤에 보여 드립니다.

  1. 로그 인덱스를 날짜로 나누는 가장 큰 이유는?

    1. 날짜별로 나누면 검색이 언제나 빨라져서
    2. 인덱스를 나눠야 복제본을 만들 수 있어서
    3. 인덱스가 여러 개면 전체 샤드 수가 줄어서
    4. 인덱스 통째로 지우는 것이 문서 삭제보다 훨씬 싸서
  2. 매핑 폭발이 클러스터를 느리게 만드는 경로는?

    1. 필드마다 파일이 생겨 디스크가 금세 차서
    2. 클러스터 상태가 커지고 그것이 모든 노드에 복제돼서
    3. 필드가 늘수록 색인 CPU 가 비례해 늘어서
    4. 노드 사이 네트워크 대역폭을 다 써서
  3. 로그 인덱스에 `dynamic: strict` 가 위험한 이유는?

    1. 예상 못 한 필드 하나에 문서가 통째로 거부되어 로그가 유실돼서
    2. 매핑을 검사하느라 색인 속도가 크게 떨어져서
    3. 거부된 문서를 따로 쌓아 두느라 디스크를 더 써서
    4. 매핑이 고정되어 복제본을 늘릴 수 없어서
  4. 파드 이름으로 집계(terms aggregation)를 하려면 필드 타입은?

    1. text
    2. wildcard
    3. keyword
    4. match_only_text
  5. 샤드 크기의 경험칙으로 적절한 것은?

    1. 1GB 이하
    2. 100GB 이상
    3. 클수록 좋다
    4. 10~50GB
  6. 로그에 트레이스 ID 를 넣는 이유는?

    1. 같은 값이 반복되어 압축률이 좋아져서
    2. 느린 요청 하나가 남긴 로그를 한 번에 모을 수 있어서
    3. ID 로 묶이면 인덱스 크기가 줄어서
    4. 사용자 정보를 대신해 개인정보를 가려서