블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3672 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 260#career 233#ai 220#llm 216#devops 195#2026-04 158#security 147#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 66#cs-fundamentals 63#rag 63#systems 63#python 55#learning 54#self-improvement 53
하네스 엔지니어링이란 무엇인가 — 모델은 고정 입력이고, 배포하는 것은 그 주위 전부입니다
같은 모델을 쓰는데 왜 팀마다 에이전트 성과가 다를까요. 대부분의 팀에게 모델은 고정 입력이고, 실제로 배포하는 것은 도구 표면, 실패 반환 형식, 루프와 정지 조건, 컨텍스트 정책, 권한, 평가자까지 모델을 둘러싼 하네스 전부입니다. 하네스 엔지니어링 시리즈 1편으로, 하네스의 정의와 여섯 개의 손잡이, 그리고 프롬프트 엔지니어링이라는 이름이 이 일을 과소평가하는 이유를 정리했습니다.
2026-08-12 · 11 분 읽기 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트루프 설계 — 무한 루프와 조기 포기 사이
에이전트 루프의 실패는 두 방향입니다. 같은 호출을 수십 번 반복하는 무한 루프와, 한 번 막히자마자 포기하는 조기 정지. 하네스 엔지니어링 시리즈 4편에서 재시도 상한, 고정 스텝·목표 체크·확신도라는 세 가지 정지 조건, 확신도 기반 정지의 함정, 그리고 사람·서브에이전트로의 에스컬레이션까지 루프 설계를 정리했습니다.
2026-08-12 · 10 분 읽기 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트리워드 해킹 — 지표는 오르는데 과제는 실패합니다
에이전트가 테스트를 통과시키는 가장 싼 방법이 테스트를 고치는 것이라면, 에이전트는 그렇게 합니다. 리워드 해킹은 버그가 아니라 우리가 정의한 목표를 정확히 최적화한 결과입니다. 하네스 엔지니어링 시리즈 6편에서 채점 기준 완화와 assertion 삭제 같은 흔한 형태, 권한 격리가 지우는 절반, 그리고 견제 지표 설계까지 리워드 해킹 대응을 정리했습니다.
2026-08-12 · 10 분 읽기 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트vLLM 메트릭 — 무엇을 대시보드에 올리고 무엇으로 알람을 걸까
vLLM이 노출하는 시계열은 GPU 메트릭이 답하지 못하는 질문에 답합니다. 지금 몇 개가 실행 중이고 몇 개가 대기 중인지, KV 캐시가 얼마나 찼는지, 첫 토큰까지 얼마나 걸리는지 같은 것들입니다. 이 글은 vLLM 공식 문서와 저장소의 메트릭 로거 소스를 직접 읽고 스케줄러 상태 게이지, 캐시 계열 카운터, 지연 히스토그램의 정확한 이름과 의미를 정리하고, 카운터 이름의 접미사 차이처럼
2026-08-12 · 13 분 읽기 #gpu#kubernetes#vllm#prometheus#observabilityMIG와 time-slicing — GPU 한 장을 여럿이 쓰는 두 가지 방법
GPU 한 장에 여러 워크로드를 올리는 방법은 크게 두 가지입니다. 시간을 나누는 time-slicing과 하드웨어를 나누는 MIG인데, 이름이 비슷해 보이는 것과 달리 격리 수준이 전혀 다릅니다. 이 글은 NVIDIA GPU Operator 공식 문서를 기준으로 두 방식의 설정 파일 구조와 노드 라벨, 광고되는 리소스 이름, 지원 하드웨어 조건을 정리하고, time-slicing 복제본 사
2026-08-12 · 12 분 읽기 #gpu#kubernetes#mig#time-slicing#nvidiaDCGM Exporter — GPU 이용률은 당신이 생각하는 그것이 아니다
DCGM Exporter는 GPU 텔레메트리를 프로메테우스 형식으로 노출하는 표준 경로지만, 가장 많이 대시보드에 올라가는 GPU 이용률 계열 메트릭은 사람들이 기대하는 것을 재지 않습니다. 이 글은 dcgm-exporter 저장소의 기본 카운터 CSV와 DCGM 공식 문서, NVML API 문서를 직접 읽고 기본으로 켜져 있는 메트릭 목록, 이용률 메트릭이 실제로 무엇을 뜻하는지, 함께 봐
2026-08-12 · 17 분 읽기 #gpu#kubernetes#dcgm#prometheus#observabilityGPU 서빙 SLO와 알람 설계 — 무엇을 약속하고 무엇을 깨울 것인가
GPU 추론 서비스에 SLO를 걸려면 먼저 어떤 지표가 사용자 경험을 대변하는지 정해야 합니다. 첫 토큰 지연과 처리량은 서로를 잡아먹는 관계라 하나만 보고 목표를 세우면 반드시 다른 쪽이 무너집니다. 이 글은 vLLM과 DCGM Exporter가 실제로 노출하는 시계열만 써서 SLI를 정의하는 방법, 히스토그램 버킷 경계를 임계값으로 삼아야 하는 이유, 포화 신호를 읽는 순서, 증상 기반
2026-08-12 · 13 분 읽기 #gpu#kubernetes#slo#alerting#prometheusGPU 장애 진단 플레이북 — 계층을 정해 놓고 내려간다
쿠버네티스에서 GPU 문제를 진단할 때 가장 큰 낭비는 순서 없이 아무 데나 찔러 보는 것입니다. 파드가 스케줄되지 않는 것, 파드는 떴는데 GPU가 안 보이는 것, 드라이버와 툴킷 버전이 어긋난 것, 메모리가 부족한 것, 노드에서 GPU가 사라지는 것은 서로 다른 계층의 문제라 확인 순서가 다릅니다. 이 글은 NVIDIA GPU Operator 공식 트러블슈팅 문서와 dcgm-exporte
2026-08-12 · 14 분 읽기 #gpu#kubernetes#troubleshooting#nvidia#gpu-operator디바이스 플러그인과 GPU 스케줄링 — nvidia.com/gpu는 어디서 오는가
쿠버네티스는 GPU를 모릅니다. 노드가 GPU를 자원으로 광고하게 만드는 것은 kubelet에 등록된 디바이스 플러그인이고, 그 결과로 생기는 이름이 확장 리소스 nvidia.com/gpu입니다. 이 글은 디바이스 플러그인이 구현해야 하는 gRPC 인터페이스와 등록 소켓 경로, 확장 리소스에서 requests와 limits가 반드시 같아야 하는 이유, GPU를 CPU처럼 밀리코어로 쪼갤 수
2026-08-12 · 11 분 읽기 #gpu#kubernetes#device-plugin#scheduling#nvidiaNVIDIA GPU Operator 소개 — 원래 손으로 깔아야 했던 여섯 조각
쿠버네티스에서 GPU를 쓰려면 드라이버, NVIDIA Container Toolkit, 디바이스 플러그인, DCGM, GPU Feature Discovery, Node Feature Discovery를 노드마다 손으로 맞춰야 했습니다. NVIDIA GPU Operator는 이 조각들을 하나의 오퍼레이터로 묶고 ClusterPolicy 하나로 상태를 관리합니다. 각 컴포넌트가 정확히 무엇을 하
2026-08-12 · 11 분 읽기 #gpu#kubernetes#gpu-operator#nvidia#dcgm기술 글쓰기와 사이드 프로젝트에 관한 한국어 글 열 편 — 시작하는 법이 아니라 계속하는 법
기술 블로그를 시작하는 법을 다룬 글은 많지만, 대부분은 첫 글까지만 데려다줍니다. 이 글은 계속 쓰는 문제와 계속 만드는 문제를 다룬 한국어 글 열 편을 모았습니다. 개발자가 글을 쓰는 이유 세 편, 습관과 플랫폼 선택을 다룬 다섯 편, 그리고 사이드 프로젝트가 실제 수익으로 이어지기까지를 기록한 두 편입니다. 링크는 모두 직접 열어 확인했으며 각 글이 어떤 단계를 다루는지와 누가 읽으면
2026-08-12 · 18 분 읽기 #큐레이션#korean-blogs#writing#side-project#indie-dev개발자 이직 후기와 연봉 협상 글 여덟 편 — 성공담이 아니라 절차를 적은 글만 골랐습니다
이직 후기는 많지만 대부분 결과만 남습니다. 이 글은 과정을 순서대로 적은 한국어 글 여덟 편을 모았습니다. 이직 전체 과정을 기록한 후기 세 편, 연봉 협상의 근거를 다룬 글 한 편, 이력서와 경력기술서 작성법 세 편, 그리고 합격 여부와 무관하게 면접을 복기한 글 한 편입니다. 링크는 모두 직접 열어 확인했으며 각 글이 어느 단계를 다루는지와 누가 읽으면 좋은지를 정리했습니다.
2026-08-12 · 17 분 읽기 #큐레이션#korean-blogs#career#job-change#salary-negotiation국내 개발 블로그 명글 큐레이션 3 — AI와 ML 실무, 직접 열어 확인한 14편
AI와 ML을 실무에서 다루는 한국어 글 중에서 구체적이고 재현 가능한 14편을 골랐습니다. LangChain RAG 파이프라인 전 과정, 임베딩과 벡터 유사도로 본 의미 검색의 원리, 벡터 데이터베이스 일곱 종 비교, pgvector에서 Qdrant로 옮긴 마이그레이션 기록, Ollama에서 vLLM으로 옮겨 처리량을 끌어올린 과정, LLM 서빙 지표의 트레이드오프, 사용량 추적기 자작기,
2026-08-12 · 23 분 읽기 #curation#큐레이션#ai#llm#rag엔지니어를 위한 한국어 돈 글 아홉 편 — 상품을 파는 글을 걷어내니 계산 구조만 남았습니다
연말정산, 4대보험, 스톡옵션 과세, 퇴직금, 프리랜서 종합소득세. 개발자가 한 번쯤 검색하지만 검색 결과의 대부분이 환급 앱과 금융 상품 광고로 채워지는 주제들입니다. 상품을 파는 글을 전부 제외하고 계산이 왜 그렇게 되는지를 설명하는 글만 남긴 결과, 아홉 편이 남았고 그중 여섯 편이 공식 안내였습니다. 링크는 모두 직접 열어 확인했으며 각 항목마다 어떤 계산 구조를 설명하는지, 누가 읽
2026-08-12 · 20 분 읽기 #큐레이션#korean-blogs#money#tax#payroll국내 개발 블로그 명글 큐레이션 1 — 백엔드와 인프라, 직접 열어 확인한 14편
한국어로 쓰인 백엔드와 인프라 글 중에서 설명이 구체적이고 재현 가능한 14편을 골라 소개합니다. Istio의 Sidecar와 ServiceEntry, Envoy의 서킷 브레이커와 라우팅, 프로메테우스 푸시 게이트웨이의 한계, JVM 메모리 구조와 GC, 클래스 패스 섀도잉, 카프카 파티션 증설 시 컨슈머 설정, 리눅스 서버를 60초 안에 파악하는 순서, HTTP Keep-Alive와 TCP
2026-08-12 · 24 분 읽기 #curation#큐레이션#backend#infra#istio노트 앱을 다섯 번 갈아탄 사람을 위한 한국어 글 아홉 편 — 도구가 아니라 구조의 문제였습니다
옵시디언과 노션을 오가며 템플릿만 다듬다가 정작 노트는 쌓이지 않는 경험은 흔합니다. 이 글은 도구 소개 대신 기록의 구조를 다루는 한국어 글 아홉 편을 모았습니다. 도구를 고르기 전에 읽을 글 세 편, 제텔카스텐이라는 연결 중심 메모법 두 편, 그리고 기록을 실제 변화로 바꾸는 회고 방법 네 편입니다. 링크는 모두 직접 열어 확인했으며 각 글이 어떤 문제를 다루는지와 누가 읽으면 좋은지를
2026-08-12 · 17 분 읽기 #큐레이션#korean-blogs#productivity#note-taking#obsidian국내 개발 블로그 명글 큐레이션 2 — 장애 회고와 트러블슈팅, 직접 열어 확인한 12편
한국 개발자가 가장 잘 쓰는 장르는 장애 회고입니다. p6spy가 DB 라우팅을 무력화한 사건, HTTP 타임아웃이 DNS 조회를 덮지 못한 이유, TCP 하프 클로즈가 중복 예외로 위장된 사례, MetalLB 설정 하나가 만든 클러스터 지연 스파이크, 힙 덤프로 OOM을 추적한 기록, JIT 워밍업으로 배포 직후 CPU 스파이크를 잡은 과정, 외래키가 부른 데드락, HikariCP 커넥션
2026-08-12 · 22 분 읽기 #curation#큐레이션#troubleshooting#postmortem#incident국내 개발 블로그 명글 큐레이션 4 — 프론트엔드, 직접 열어 확인한 14편
프론트엔드 주제로 한국어로 쓰인 글 중에서 설명이 구체적이고 재현 가능한 14편을 골랐습니다. 실행 컨텍스트로 설명하는 클로저, 자바스크립트가 프로토타입을 택한 배경, 타입스크립트 조건부 타입과 infer, 타입 시스템이 증명처럼 작동하는 이유, 리플로우와 리페인트, React Fiber 리컨실러, useLayoutEffect로 잡은 마커 렌더링, 번들러 네 종의 계보, 선언적 프로그래밍에
2026-08-12 · 22 분 읽기 #curation#큐레이션#frontend#javascript#typescript국내 개발 블로그 명글 큐레이션 5 — 커리어와 성장, 직접 열어 확인한 14편
개발자 커리어와 성장을 다룬 한국어 글 중에서 구체적이고 재현 가능한 14편을 골랐습니다. 이력서를 공개하며 원칙을 밝힌 글 두 편과 이력서를 서사로 보는 관점, AI 시대에 성장이 멈추는 구조와 일하는 방식의 변화, 무엇을 써야 하는가에 대한 답, 단점과 약점을 가르는 언어, 번아웃을 겪고 나온 기록, 프로그래머의 수명, 완벽주의를 내려놓은 이야기, 초보 팀장의 1년 회고, 조직의 지속성을
2026-08-12 · 23 분 읽기 #curation#큐레이션#career#growth#resume평가자 병목 — 약한 채점자가 시스템 전체의 상한이 됩니다
하네스를 아무리 고쳐도 점수가 안 오른다면, 병목은 하네스가 아니라 평가자일 수 있습니다. 측정할 수 없는 품질은 선택할 수 없고, 그래서 약한 채점자가 시스템 전체의 상한이 됩니다. 하네스 엔지니어링 시리즈 5편에서 스모크 테스트부터 단위 테스트, 루브릭, 채점 자료 격리, 견제 지표 패널까지 평가자의 사다리와 평가 보정을 먼저 해야 하는 이유를 정리했습니다.
2026-08-12 · 10 분 읽기 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트