태그: #운영
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 14 편
프로세스와 시그널 완전 가이드: 종료가 안 되는 이유를 끝까지 추적하기
시그널 번호와 기본 동작, SIGTERM과 SIGKILL의 차이, 좀비와 고아, 프로세스 그룹과 세션, nohup과 setsid, 그리고 우아한 종료를 설계하는 방법까지 정리합니다. 죽지 않는 프로세스의 원인을 계층별로 추적합니다.
2026-08-15 · 29 분 읽기 #리눅스#프로세스#시그널#운영#커널리눅스 성능 도구 완전 가이드: 출력의 숫자를 해석하는 법
top, vmstat, iostat, pidstat, sar, perf가 찍어 주는 숫자를 한 열씩 해석합니다. 어떤 도구가 어떤 질문에 답하는지, 어떤 값이 착시를 일으키는지, USE 방법론으로 도구를 고르는 순서까지 정리했습니다.
2026-08-15 · 29 분 읽기 #리눅스#성능#모니터링#운영#sysstat파일 디스크립터와 inode 완전 가이드: df와 du가 다를 때 무슨 일이 벌어지는가
inode와 디렉터리 엔트리의 관계에서 출발해 하드 링크, 삭제된 열린 파일, inode 고갈, 파일 디스크립터 한도까지 정리합니다. df와 du가 어긋나는 이유와 복구 방법을 명령 단위로 다룹니다.
2026-08-15 · 27 분 읽기 #리눅스#파일시스템#inode#파일디스크립터#운영TLS 인증서 완전 가이드: openssl 명령으로 끝까지 다루기
인증서를 읽고, CSR을 만들고, 체인을 검증하고, 형식을 변환하고, 서버 연결을 진단하는 openssl 명령을 목적별로 정리합니다. 만료와 체인 누락, 키 불일치를 현장에서 판별하는 방법까지 다룹니다.
2026-08-15 · 29 분 읽기 #리눅스#tls#인증서#openssl#보안리눅스 로그 운영 완전 가이드: journald, rsyslog, logrotate를 하나로 엮기
저널의 보존 정책, rsyslog로의 전달, logrotate의 회전 방식까지 리눅스 호스트의 로그 배관을 설계합니다. 디스크를 채우지 않으면서 장애 조사에 필요한 기록을 남기는 기준을 정리합니다.
2026-08-15 · 26 분 읽기 #리눅스#로그#journald#rsyslog#logrotateGit 되돌리기 완전 가이드: 복구되는 것과 영원히 사라지는 것
reset, revert, restore, reflog, fsck의 경계선을 복구 가능성 기준으로 정리합니다. reflog 만료 정책과 gc가 언제 객체를 실제로 지우는지, 강제 푸시 사고와 워크트리·서브모듈 상황까지 다룹니다.
2026-08-15 · 27 분 읽기 #git#버전관리#복구#운영#협업DNS 완전 가이드: 이름이 주소가 되는 경로를 끝까지 따라가기
스텁 리졸버부터 권한 서버까지 이름 해석 경로를 구간별로 나누고, 레코드 타입과 TTL, 위임, dig 출력 해석, 전파 지연과 스테일 캐시, DNSSEC, 사내 DNS 운영까지 정리합니다. 명령과 규칙은 RFC 원문과 매뉴얼에서 확인한 것만 실었습니다.
2026-08-15 · 45 분 읽기 #리눅스#dns#네트워크#운영#트러블슈팅커넥션 풀 완전 가이드: 풀링 모드가 애플리케이션과 맺는 계약
PostgreSQL 18과 PgBouncer를 기준으로 커넥션 풀을 계약의 관점에서 정리합니다. 세션·트랜잭션·문장 풀링 세 가지 모드가 각각 무엇을 보장하고 무엇을 포기하는지, 트랜잭션 풀링에서 준비된 문장과 SET, LISTEN/NOTIFY, 어드바이저리 락이 왜 깨지는지, 애플리케이션 풀과 PgBouncer와 maxconnections 사이의 삼중 예산을 어떻게 배분하는지, 그리고 타임
2026-08-15 · 30 분 읽기 #데이터베이스#postgresql#pgbouncer#커넥션풀#운영DB 성능 튜닝 완전 가이드: 파라미터를 만지기 전에 측정하는 순서
PostgreSQL 18을 기준으로 성능 튜닝을 파라미터 목록이 아니라 진단 순서로 정리합니다. pgstatstatements로 워크로드를 프로파일링하고, 대기 이벤트로 병목의 성격을 가르고, 캐시와 I/O 지표를 읽고, 그다음에야 메모리 예산과 체크포인트와 autovacuum을 조정하는 순서입니다. PostgreSQL 18에서 바뀐 기본값들과 변경 전후를 비교하는 방법까지 다룹니다.
2026-08-15 · 32 분 읽기 #데이터베이스#postgresql#성능튜닝#모니터링#운영PostgreSQL 인덱스 완전 가이드: 설계부터 폐기까지 인덱스의 수명 주기
PostgreSQL 18을 기준으로 인덱스를 하나의 운영 자산으로 다룹니다. 어떤 컬럼을 어떤 순서로 넣을지 정하는 설계, 여섯 가지 인덱스 방식 중 하나를 고르는 판단, CONCURRENTLY로 안전하게 만드는 절차와 실패 복구, 정말 쓰이는지 확인하는 검증, 부풀어 오른 인덱스를 다시 만드는 운영, 그리고 되돌릴 수 있게 폐기하는 방법까지 수명 주기 순서로 정리합니다.
2026-08-15 · 33 분 읽기 #데이터베이스#postgresql#인덱스#성능튜닝#운영대용량 데이터 처리 완전 가이드: COPY, 청크 배치, 그리고 되돌릴 수 있는 작업
PostgreSQL 18에서 수억 행을 적재하고 갱신하고 삭제하는 작업을 안전하게 수행하는 방법을 정리합니다. COPY의 옵션과 기본값, 문서가 권장하는 초기 적재 절차, ONERROR로 불량 행을 견디는 방법, 대량 UPDATE와 DELETE를 청크로 나누는 설계, 삭제 이후의 죽은 행 처리와 VACUUM FULL을 피해야 하는 이유, 그리고 재개 가능한 백필 작업을 만드는 방법까지 다룹니
2026-08-15 · 33 분 읽기 #데이터베이스#postgresql#배치처리#데이터적재#운영SSH 운영 완전 가이드: 키 관리부터 잠금 사고 없는 서버 하드닝까지
sshdconfig 하드닝, 키 종류 선택과 배포, ProxyJump와 포트 포워딩, 접속이 안 될 때의 디버깅 순서까지 운영자 관점에서 정리합니다. 설정을 바꾸다 스스로 잠기지 않는 절차를 포함합니다.
2026-08-15 · 29 분 읽기 #리눅스#ssh#보안#운영#서버관리리눅스 장애 대응 명령어 완전 가이드: 첫 60초부터 근본 원인까지
서버가 이상하다는 연락을 받은 순간부터 순서대로 실행하는 진단 명령어를 정리합니다. uptime, top, free, df, iostat, ss, journalctl까지 각 출력의 어느 숫자를 봐야 하는지, 그 숫자가 무엇을 배제하고 무엇을 남기는지 설명합니다.
2026-08-15 · 30 분 읽기 #리눅스#트러블슈팅#운영#장애대응#명령어백업과 복구 완전 가이드: 복구 시나리오에서 거꾸로 설계하기
RPO와 RTO에서 출발해 rsync, tar, LVM 스냅샷, 스냅샷 기반 백업 도구를 고르는 기준을 정리합니다. 복구 리허설 절차와 백업이 조용히 망가지는 다섯 가지 방식까지 다룹니다.
2026-08-15 · 27 분 읽기 #리눅스#백업#복구#재해복구#운영