블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3672 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 260#career 233#ai 220#llm 216#devops 195#2026-04 158#security 147#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 66#cs-fundamentals 63#rag 63#systems 63#python 55#learning 54#self-improvement 53
AI 시대 개발자 커리어 전략: 5년 후를 준비하는 현실적인 로드맵
AI가 개발자를 대체한다는 공포에서 벗어나, 진짜 현실을 직시하고 5년 후를 준비하는 구체적인 커리어 전략을 이야기합니다. 솔직하게, 그리고 현실적으로.
2026-03-18 · 13 분 읽기 #개발자커리어#AI시대#커리어전략#개발자성장#ai-developmentTool Calling 실전 가이드: AI가 외부 세계를 다루는 방법과 흔한 함정들
Tool Calling은 LLM을 진짜 에이전트로 만드는 핵심 메커니즘입니다. OpenAI function calling 구현부터 병렬 실행, 그리고 현업에서 실제로 마주치는 함정과 해결법까지 실전 중심으로 정리했습니다.
2026-03-18 · 13 분 읽기 #tool-calling#function-calling#ai-agent#llm#ai-development시지프스는 행복하다: 반복 업무의 철학과 개발자의 의미 찾기
알베르 카뮈의 시지프스 신화(1942)에서 시작하는 반복 업무의 철학. 끝없는 버그 큐, 영원히 리팩터링되는 코드베이스, 절대 끝나지 않는 스프린트—그 안에서 행복을 찾는 법.
2026-03-18 · 15 분 읽기 #카뮈#시지프스#부조리#반복업무#philosophy아리스토텔레스의 에우다이모니아: 번영하는 개발자의 삶을 위한 철학
아리스토텔레스의 에우다이모니아(εὐδαιμονία) 개념을 통해 단순한 즐거움을 넘어 진정으로 번영하는 개발자의 삶을 탐구합니다. 덕성, 우정, 목적이 어떻게 우리를 완성시키는지 알아봅니다.
2026-03-18 · 31 분 읽기 #아리스토텔레스#에우다이모니아#행복#philosophy#developerAMD GPU & ROCm 완전 분석: CUDA의 대안은 가능한가?
AMD MI300X의 192GB HBM3 메모리, ROCm 소프트웨어 스택, HIP 프로그래밍 모델을 심층 분석합니다. vLLM과 llama.cpp로 실제 LLM 서빙 성능을 측정하고, NVIDIA CUDA 대비 현실적인 장단점과 선택 기준을 제시합니다.
2026-03-18 · 22 분 읽기 #amd#rocm#gpu#mi300x#LLM서빙연어처럼, 거슬러 오르라: 역경과 회복탄력성의 과학
태평양을 3,200km 거슬러 오르는 연어의 여정에서 배우는 회복탄력성의 과학. 역경을 통과하는 개발자를 위한 심리학 기반 5가지 실천법.
2026-03-18 · 14 분 읽기 #연어#회복탄력성#역경#목적#natureRAG 청킹 전략 완전 가이드: 나이브 분할부터 RAPTOR까지
RAG 시스템 품질의 70%를 결정하는 청킹 전략을 5가지 방법론과 실제 코드로 완전 정리합니다. Fixed-size부터 Semantic, Parent-Child, RAPTOR까지 — 각각 언제 쓰는지, 실전 평가 방법까지 다룹니다.
2026-03-18 · 14 분 읽기 #rag#청킹#텍스트분할#langchain#raptorNVIDIA GPU와 CUDA 완전 해부: 왜 GPU가 AI를 지배하는가
H100 스펙부터 Tensor Core WMMA API까지. SIMT 실행 모델, 공유 메모리 타일링, Warp divergence를 실제 CUDA 코드와 함께 완전 해부한다.
2026-03-18 · 22 분 읽기 #cuda#gpu#nvidia#행렬연산#병렬컴퓨팅Multi-Agent 시스템 완전 비교: AutoGen, CrewAI, LangGraph 중 무엇을 선택하는가
AutoGen, CrewAI, LangGraph — 세 Multi-Agent 프레임워크를 실제 코드와 함께 비교합니다. 각각의 철학, 장단점, 그리고 어떤 상황에 무엇을 선택해야 하는지 현업 엔지니어 관점에서 정리했습니다.
2026-03-18 · 15 분 읽기 #multi-agent#autogen#crewai#langgraph#ai-agent마이클 조던의 실패 철학: 9,000번의 실패가 만든 전설
마이클 조던의 실패 철학과 캐롤 드웩의 성장 마인드셋 연구를 개발자의 성장에 적용한다. 9,000번의 슛 실패, 300번의 패배, 그 모든 실패가 전설을 만든 이유를 탐구한다.
2026-03-18 · 14 분 읽기 #마이클조던#실패#성장마인드셋#그릿#동기부여LLM 서빙 최적화 완전 가이드: KV Cache, PagedAttention, 양자화의 모든 것
LLM 서빙의 핵심 최적화 기술을 완전 해부한다. KV Cache의 메모리 문제부터 PagedAttention의 가상 메모리 혁신, 연속 배칭, 추측 디코딩, 양자화, 그리고 vLLM/TGI/TensorRT-LLM 비교까지.
2026-03-18 · 48 분 읽기 #LLM서빙#KV캐시#paged-attention#vllm#양자화LLM Agent 설계 패턴 완전 가이드: ReAct부터 Multi-Agent까지
ReAct, Chain of Thought, Plan-and-Execute, Reflection, Tree of Thoughts — LLM Agent를 실제로 만들 때 어떤 패턴을 언제 써야 하는지, 현업 엔지니어 관점에서 정리했습니다.
2026-03-18 · 12 분 읽기 #ai-agent#react#llm#설계패턴#ai-developmentHybrid Search 완전 가이드: BM25와 벡터 검색을 합치면 RAG가 달라진다
BM25와 벡터 검색의 약점을 서로 보완하는 Hybrid Search를 RRF(Reciprocal Rank Fusion)로 구현하는 방법을 실제 코드와 함께 설명합니다. 순수 벡터 검색의 한계, BM25의 강점, 그리고 LangChain으로 실전 구현하는 방법을 다룹니다.
2026-03-18 · 10 분 읽기 #하이브리드검색#bm25#벡터검색#rag#rrf비고츠키의 선물: 페어 프로그래밍의 숨겨진 심리학
레프 비고츠키의 근접발달영역(ZPD) 이론이 페어 프로그래밍, 코드 리뷰, 모브 프로그래밍의 과학적 토대임을 밝히고, 어떻게 함께 배우는 것이 혼자 배우는 것보다 강력한지 탐구합니다.
2026-03-18 · 32 분 읽기 #비고츠키#근접발달영역#페어프로그래밍#학습심리학#코드리뷰칙센트미하이의 플로우: 코딩이 명상이 되는 순간
이 글은 플로우를 왜 개발자가 진지하게 이해해야 하는지 설명하는 개념 편이다. 칙센트미하이의 8가지 조건, 딥워크와의 관계, 현대 업무 환경의 방해 요소, 그리고 소진과의 경계를 심리적 맥락 중심으로 정리한다.
2026-03-18 · 32 분 읽기 #플로우#몰입#칙센트미하이#deep-work#집중도파민의 배신, 그리고 화해: 개발자를 위한 뇌과학 생산성 가이드
도파민은 쾌락이 아니라 "원함"의 호르몬이다. 켄트 베리지의 인센티브 현저성 이론부터 안나 렘케의 고통-쾌락 시소까지 — 개발자의 뇌를 하이재킹하는 기술에 맞서 지속 가능한 동기를 설계하는 법.
2026-03-18 · 17 분 읽기 #도파민#신경과학#동기부여#focus#productivityVector DB 완전 비교 2025: Pinecone, Weaviate, Chroma, pgvector 중 무엇을 선택하는가
2025년 기준 주요 벡터 데이터베이스인 Pinecone, Weaviate, Chroma, pgvector를 성능·비용·운영 복잡도 측면에서 실용적으로 비교하고, 상황별 최적 선택을 안내합니다.
2026-03-18 · 14 분 읽기 #vector-db#pinecone#weaviate#chroma#pgvectorcuDNN 완전 해부: 딥러닝 연산이 GPU에서 빛처럼 빠른 이유
im2col 변환부터 Winograd 알고리즘, FlashAttention 타일링, TensorRT INT8 양자화까지. cuDNN이 딥러닝 연산을 어떻게 10~100배 빠르게 만드는지 실제 코드와 함께 완전 해부한다.
2026-03-18 · 20 분 읽기 #cudnn#gpu#nvidia#딥러닝최적화#컨볼루션세네카가 슬랙을 쓴다면: 항상 연결된 개발자를 위한 시간 철학
2,000년 전 세네카의 시간 철학 "Dum differtur vita transcurrit"을 통해, 슬랙 알림과 끊임없는 방해 속에서 사는 현대 개발자가 어떻게 시간의 주인이 될 수 있는지 탐구합니다.
2026-03-18 · 30 분 읽기 #세네카#시간철학#스토아#집중#디지털미니멀리즘대나무의 5년: 보이지 않는 성장에 대한 개발자의 명상
모소 대나무는 5년간 땅속에서 뿌리를 내린 후 6주 만에 27미터를 자란다. 이 경이로운 성장의 비밀이 개발자의 성장에 던지는 깊은 통찰 — 당신은 지금 보이지 않는 곳에서 자라고 있다.
2026-03-18 · 18 분 읽기 #대나무#growth#인내#보이지않는노력#nature