블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3672 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 260#career 233#ai 220#llm 216#devops 195#2026-04 158#security 147#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 66#cs-fundamentals 63#rag 63#systems 63#python 55#learning 54#self-improvement 53
Elasticsearch와 OpenSearch, Lucene의 내부 — Inverted Index, BM25, Sharding, Vector Search, Hybrid RAG까지 (2025)
검색은 왜 어렵나? Lucene의 Segment와 Merge, Inverted Index의 수학, BM25가 TF-IDF를 어떻게 이겼나, primary/replica shard와 routing, Ingest 파이프라인, Query DSL의 미로, kNN과 HNSW, 2021년 Elastic vs AWS 라이선스 전쟁과 OpenSearch 포크, Hybrid Search로 완성되는 RAG 시
2026-04-15 · 20 분 읽기 #elasticsearch#opensearch#lucene#search#vector-search분산 락 완전 가이드 2025: Redlock, Zookeeper, etcd, Fencing Token, 안전한 구현
분산 락의 모든 것! 왜 어려운가, Redis 단일 락, Redlock 알고리즘, Martin Kleppmann의 비판, Zookeeper/etcd 기반 락, Fencing Token, 실전 구현, 함정 회피.
2026-04-15 · 18 분 읽기 #distributed-lock#redis#redlock#zookeeper#etcdCUDA GPU 프로그래밍 모델 Deep Dive — SIMT, 메모리 계층, Tensor Core, 커널 최적화 완전 정복 (2025)
ChatGPT, Stable Diffusion, Sora를 돌리는 엔진, NVIDIA GPU와 CUDA. 이 글은 CUDA 프로그래밍 모델을 처음부터 해부합니다. GPU 하드웨어 아키텍처(SM, Warp, CUDA Core), SIMT vs SIMD, 스레드 계층(Grid/Block/Thread), 메모리 계층(Global/Shared/Constant/Register), Memory Coal
2026-04-15 · 36 분 읽기 #cuda#gpu#nvidia#ai#machine-learningCPU 캐시 & 메모리 계층 완전 가이드 2025: L1/L2/L3, Cache Line, False Sharing, 성능 최적화
메모리 계층의 모든 것! L1/L2/L3 cache, Cache line, MESI 프로토콜, False sharing, Cache-friendly 자료구조, NUMA, Mechanical Sympathy, 실전 성능 최적화.
2026-04-15 · 18 분 읽기 #cpu-cache#memory#performance#cache-line#false-sharing컨테이너 완벽 가이드 — 내부 구조: Namespaces, cgroups, OCI Runtime, runc, containerd, overlayfs, seccomp, Capabilities (2025)
컨테이너의 모든 것 — 1979년 chroot에서 시작해 FreeBSD jails, Solaris zones, Google cgroups(2006), LXC, Docker(2013), OCI 표준화까지의 역사. 8가지 Linux namespaces, cgroups v1과 v2, OCI Runtime Specification, runc와 containerd 스택, OCI 이미지 layer 모델
2026-04-15 · 53 분 읽기 #linux#container#docker#kubernetes#cgroups컴퓨터 아키텍처의 현대 — CPU 파이프라인·Out-of-Order·캐시·브랜치 예측·Meltdown·Apple Silicon·ARM·RISC-V·SIMD·GPU 심층 가이드 (2025)
왜 배열이 linked list를 이기는가, 왜 분기가 10배 느려지는가, M1이 Intel을 어떻게 이겼는가. CPU 파이프라인·Out-of-Order·L1~L3 캐시·브랜치 예측·Meltdown/Spectre·Apple Silicon·ARM/x86/RISC-V·SIMD·GPU SM/Warp·HBM/CXL까지 — 소프트웨어 엔지니어가 알아야 할 2025년 하드웨어 전부.
2026-04-15 · 28 분 읽기 #computer-architecture#cpu#cache#branch-prediction#apple-silicon컴파일러와 링커 내부 완전 정복 — #include부터 실행 파일이 되기까지 ELF, 심볼, 정적/동적 링킹, 재배치, LTO (2025)
"hello.c"가 실행 파일이 되는 여정을 원자 단위로 추적한다. 전처리 / 컴파일 / 어셈블 / 링크의 4단계, ELF 파일 레이아웃, 심볼 테이블과 재배치, 정적 라이브러리의 아카이브 구조, 동적 링커 ld.so의 GOT/PLT 트릭, C++ 이름 맹글링의 혼돈, LTO가 왜 "전체 프로그램 최적화"인지, 그리고 Rust/Go가 왜 고전적 링킹과 다른 길을 갔는지 — 오늘도 우리가 gc
2026-04-15 · 31 분 읽기 #compiler#linker#elf#symbol#static-linking클라우드 네이티브 완전 가이드 — Kubernetes·Serverless·eBPF·Container Runtime·GitOps를 2025년 기준으로 한 번에 정리
Kubernetes 핵심 개념, Serverless/Container/VM 선택, eBPF 혁명(Cilium/Falco), Container Runtime(containerd/Kata/Firecracker), GitOps(ArgoCD/Flux), Karpenter와 Spot까지 — 클라우드 네이티브 2025.
2026-04-15 · 22 분 읽기 #cloud-native#kubernetes#serverless#ebpf#containerCDC (Change Data Capture) 완전 가이드 2025: Debezium, Kafka, 데이터 동기화, Outbox 패턴
CDC의 모든 것! 동작 원리(WAL/binlog 기반), Debezium 아키텍처, PostgreSQL Logical Replication, MySQL binlog, Outbox 패턴, 데이터 웨어하우스 동기화, Kafka 통합, 마이그레이션, 흔한 함정.
2026-04-15 · 17 분 읽기 #cdc#debezium#kafka#postgresql#mysqlCDN & Edge 캐싱 전략 완전 가이드 2025: Cache Invalidation, ETag, Stale-While-Revalidate
CDN과 캐싱의 모든 것! HTTP 캐시 헤더(Cache-Control/ETag/Vary), CDN 동작 원리, Edge 캐싱, 캐시 무효화의 어려움(2가지 어려운 문제), Stale-While-Revalidate, Cloudflare/Fastly/CloudFront 비교.
2026-04-15 · 20 분 읽기 #cdn#cache#edge-computing#http-cache#cache-invalidation빅테크 개발 문화 완전 가이드: Google, Meta, Amazon, Netflix, Apple은 어떻게 다른가 (2025)
Google의 Design Doc, Meta의 Move Fast, Amazon의 6-page Memo, Netflix의 Keeper Test, Apple의 비밀주의까지. 5대 빅테크와 한국 빅테크(네이버, 카카오, 쿠팡)의 실제 개발 문화를 비교. 퍼프 리뷰, 코드 리뷰, 온콜, 성장 사다리, 의사결정 구조의 차이. 어떤 문화가 당신 회사에 맞는가. 문화를 모방할 수 있는가, 아니면 컨텍스트
2026-04-15 · 27 분 읽기 #culture#engineering-management#google#meta#amazon비동기 I/O 모델 완전 가이드 2025: epoll, io_uring, Reactor/Proactor, async/await 내부
비동기 I/O의 모든 것! Blocking/Non-blocking/Async, select/poll/epoll/kqueue 진화, iouring 혁명, Reactor/Proactor 패턴, Tokio/libuv 내부, async/await가 하는 일.
2026-04-15 · 15 분 읽기 #async-io#epoll#io-uring#reactor#proactorAPI 디자인 완전 가이드 — REST·OpenAPI·Versioning·Pagination·Idempotency·Webhook을 2025년 기준으로 한 번에 정리
REST Maturity, OpenAPI 3.1, Versioning 전략, Pagination(Offset/Cursor/Keyset), Idempotency Key, Rate Limiting, Webhook 재전송, Async API까지 — API 디자인 2025.
2026-04-15 · 20 분 읽기 #api#rest#openapi#webhook#versioningAI 제품 디자인 완전 가이드: 생성 UI, 신뢰, 피드백, 스트리밍, 에이전트 UX, 한국 문화 특화 (2025)
좋은 AI 제품은 좋은 모델 + 좋은 UX가 아니라, "제약 안에서 신뢰를 만드는 UX 설계"다. 확정적 UI와 생성적 UI의 경계, 신뢰·불확실성·편집 가능성 디자인, 스트리밍·피드백·실패 UX, 에이전트와 음성의 UX 패턴, 온보딩·접근성·윤리, 한국 문화와 한국어 특수성까지. 엔지니어와 디자이너가 함께 읽는 한 편.
2026-04-15 · 17 분 읽기 #ai-product-design#ux#generative-ui#trust#streamingAI Engineering 프로덕션 실전 완전 가이드 — RAG·Evals·Fine-tuning·LLMOps·Guardrails·Prompt Caching·비용 최적화까지 2025-2026년 현장 노하우
LLM을 프로토타입에서 프로덕션으로 가져가는 여정은 Jupyter 노트북의 데모와 다르다. RAG 파이프라인 설계, eval harness 구축, fine-tuning 결정 트리, LLMOps 관측 가능성, Guardrails와 안전성, Prompt Caching과 비용 최적화까지 2025-2026년 AI 엔지니어의 현장 가이드를 500줄로 정리한다.
2026-04-15 · 20 분 읽기 #ai-engineering#llm#rag#evaluation#fine-tuningZero Trust 아키텍처 완전 가이드 2025: Never Trust Always Verify, BeyondCorp, SASE
Zero Trust의 모든 것! Never Trust Always Verify 원칙, Google BeyondCorp, 마이크로세그멘테이션, ZTNA(Zero Trust Network Access), SASE, 아이덴티티 기반 보안, 최소 권한, 지속적 검증, 구현 로드맵, 도구(Zscaler/Cloudflare/Tailscale).
2026-04-14 · 36 분 읽기 #zero-trust#security#identity#beyondcorp#saseTCP/IP & 네트워크 프로그래밍 심화 가이드 2025: 소켓, HTTP/3, QUIC, DNS, TLS 1.3
네트워크 프로그래밍 심화! TCP 3-way/4-way 핸드셰이크, 혼잡 제어(Cubic/BBR), 소켓 프로그래밍(epoll/kqueue/iouring), HTTP/1.1 vs HTTP/2 vs HTTP/3(QUIC), DNS 해석 과정, TLS 1.3 핸드셰이크, 네트워크 디버깅(tcpdump/Wireshark).
2026-04-14 · 29 분 읽기 #tcp-ip#networking#socket#http3#quicWebAssembly 완전 가이드 2025: 브라우저를 넘어서 — WASI, Component Model, 서버사이드 Wasm
WebAssembly의 모든 것! Wasm 기초(바이너리 포맷/선형 메모리/테이블), WASI(시스템 인터페이스), Component Model(모듈 조합), 서버사이드 Wasm(Fermyon Spin/wasmCloud), Docker+Wasm, Edge Wasm(Cloudflare Workers), 언어 지원(Rust/Go/Python).
2026-04-14 · 29 분 읽기 #webassembly#wasi#component-model#server-side#edge-computingServerless 아키텍처 패턴 완전 가이드 2025: Lambda, Step Functions, 이벤트 소싱, 비용 최적화
Serverless 패턴의 모든 것! Lambda 설계 패턴(단일 목적/모놀리식/Fan-out), Step Functions(상태 머신/워크플로), Cold Start 최적화, Provisioned Concurrency, Serverless DB(Aurora Serverless/DynamoDB), 비용 모델, Serverless vs Container.
2026-04-14 · 31 분 읽기 #serverless#lambda#step-functions#event-driven#cold-startSRE 실전 가이드 2025: 인시던트 관리, 포스트모템, Error Budget, On-Call, Toil 제거
SRE 실전의 모든 것! 인시던트 관리(탐지→대응→복구→포스트모템), Error Budget 정책, On-Call 운영(로테이션/에스컬레이션/피로도 관리), Toil 제거 자동화, SLO/SLI/SLA 설정, Blameless 포스트모템 작성법, Google SRE 문화.
2026-04-14 · 47 분 읽기 #sre#site-reliability#incident-management#postmortem#error-budget