블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3673 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 260#career 233#ai 221#llm 217#devops 195#2026-04 158#security 147#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 66#cs-fundamentals 63#rag 63#systems 63#python 55#learning 54#self-improvement 53
LLM 추론 서빙 프레임워크 비교: TensorRT-LLM vs vLLM vs SGLang 프로덕션 배포 전략
LLM 추론 서빙 3대 프레임워크를 비교합니다. TensorRT-LLM의 하드웨어 최적화, vLLM의 PagedAttention과 프로덕션 스택, SGLang의 RadixAttention과 구조화 생성까지 벤치마크 데이터와 배포 코드로 최적의 선택을 안내합니다.
2026-03-12 · 31 분 읽기 #llm#inference#tensorrt-llm#vllm#sglangKubernetes Network Policy 실전 가이드: Calico·Cilium 기반 마이크로세그멘테이션과 Zero-Trust 네트워크 보안
Kubernetes 환경에서 Network Policy를 활용한 마이크로세그멘테이션 전략을 다룹니다. 기본 NetworkPolicy API부터 Calico GlobalNetworkPolicy, Cilium L7 정책, eBPF 기반 enforcement까지 프로덕션 보안 아키텍처를 코드와 함께 구현합니다.
2026-03-12 · 37 분 읽기 #kubernetes#network-policy#calico#cilium#security알고리즘 트레이딩 백테스팅 실전: Python Backtrader·전략 구현·성과 평가·리스크 관리
Python Backtrader를 활용한 알고리즘 트레이딩 백테스팅의 전 과정을 다룹니다. 백테스팅 기초(Walk-Forward, Look-Ahead Bias, Survivorship Bias), Backtrader 아키텍처, SMA 교차·RSI·볼린저 밴드 전략 구현, 주문 유형과 실행, Sharpe Ratio·Max Drawdown·Calmar Ratio 성과 평가, 포지션 사이징과 손절
2026-03-12 · 22 분 읽기 #finance#algorithmic-trading#backtesting#backtrader#python기술 문서 영어 작성 가이드: RFC·ADR·Design Doc·Tech Spec 템플릿과 실전 표현
소프트웨어 엔지니어를 위한 기술 문서 영어 작성 가이드입니다. RFC, ADR, Design Doc, Tech Spec의 구조와 템플릿을 비교하고, 각 섹션별 핵심 영어 표현(Problem Statement, Proposed Solution, Alternatives Considered, Trade-offs, Success Metrics)과 리뷰 피드백 표현, 비영어권 화자의 흔한 실수까지 실
2026-03-12 · 31 분 읽기 #english#technical-writing#rfc#adr#design-docIT 엔지니어를 위한 일본어 코드 리뷰 커뮤니케이션 가이드: 리뷰 요청·피드백·제안 표현과 비즈니스 일본어
일본 IT 기업에서 코드 리뷰 시 사용하는 비즈니스 일본어를 체계적으로 정리합니다. 리뷰 요청 경어, 피드백 작성법, 정중한 제안 표현, 코멘트 프리픽스(LGTM/nit/MUST), 심리적 안전성을 높이는 커뮤니케이션 패턴까지 실전 예문과 함께 다룹니다.
2026-03-12 · 49 분 읽기 #japanese#code-review#communication#keigo#engineer일본어 실전 OUTPUT 훈련 #25 — 쇼핑/편의점/백화점
쇼핑 상황에서 바로 쓰는 일본어 OUTPUT 훈련: 사이즈·재고·포장·면세 표현
2026-03-12 · 4 분 읽기 #japanese#speaking#shopping#convenience-store#department-storeIT 엔지니어를 위한 일본어 애자일·스크럼 미팅 표현: 스프린트 회고·데일리 스탠드업·백로그 관리
IT 엔지니어를 위한 일본어 애자일·스크럼 미팅 표현 가이드입니다. 데일리 스탠드업(朝会)에서의 보고 표현, 스프린트 플래닝 어휘, KPT 기반 스프린트 회고 표현, 백로그 리파인먼트 표현, 스토리 포인트 추정 토론, 스크럼 마스터 역할 표현, 경어(敬語) 레벨별 미팅 표현까지 실전 중심으로 정리합니다.
2026-03-12 · 38 분 읽기 #japanese#agile#scrum#sprint-retrospective#daily-standup스프린트 플래닝·추정 회의 영어 표현 가이드: Story Point 논의·기술 부채 대화·백로그 리파인먼트 실전 영어
스프린트 플래닝과 추정 회의에서 사용하는 핵심 영어 표현을 정리합니다. Story Point 논의, 기술 부채 커뮤니케이션, 백로그 리파인먼트, 프로페셔널한 의견 불일치 표현까지 비영어권 엔지니어를 위한 실전 대화 가이드입니다.
2026-03-12 · 34 분 읽기 #english#sprint-planning#estimation#agile#scrumPostgreSQL VACUUM과 MVCC 내부 구조 완벽 가이드: 테이블 Bloat 방지·Autovacuum 튜닝·XID Wraparound 대응
PostgreSQL의 MVCC 아키텍처와 VACUUM 메커니즘을 내부 구조부터 실전 운영까지 다룹니다. Dead tuple 관리, 테이블 Bloat 탐지·방지, Autovacuum 파라미터 튜닝, XID Wraparound 예방, pgrepack을 활용한 무중단 Bloat 제거까지 프로덕션 DBA를 위한 완벽 가이드입니다.
2026-03-12 · 28 분 읽기 #database#postgresql#vacuum#mvcc#autovacuumRedis 클러스터 아키텍처와 고가용성 운영 가이드: Sentinel·Cluster 모드·메모리 최적화·장애 복구
Redis Standalone·Sentinel·Cluster 세 가지 배포 모드를 비교하고, Sentinel 쿼럼 기반 장애 감지·자동 페일오버, Cluster 해시 슬롯·리샤딩·PSYNC 복제, maxmemory 정책·LRU/LFU 축출, RDB/AOF 영속화, 슬로우 로그 분석, 메모리 단편화 대응, Split-brain·OOM 장애 시나리오와 복구 절차를 실전 예제로 정리합니다.
2026-03-12 · 22 분 읽기 #database#redis#cluster#sentinel#high-availabilityGitHub Actions 고급 패턴: Reusable Workflows·Composite Actions·모노레포 CI/CD 최적화 전략
GitHub Actions의 고급 패턴을 다룹니다. Reusable Workflows로 파이프라인 템플릿화, Composite Actions로 재사용 가능한 스텝 구성, 모노레포 환경에서 path-filter·matrix·캐싱 기반 CI/CD 최적화까지 실전 코드와 함께 구현합니다.
2026-03-12 · 23 분 읽기 #devops#github-actions#ci-cd#monorepo#reusable-workflows정량적 리스크 관리 실전 가이드: VaR·CVaR·포트폴리오 리스크 메트릭 Python 구현
금융 리스크 관리의 핵심 지표인 VaR과 CVaR(Expected Shortfall)을 이론부터 Python 구현까지 다룹니다. Historical·Parametric·Monte Carlo 3가지 VaR 산출법, CVaR 포트폴리오 최적화, Basel III/IV 규제 프레임워크까지 실무 퀀트를 위한 완벽 가이드입니다.
2026-03-12 · 33 분 읽기 #finance#risk-management#var#cvar#portfolioAI Agent Function Calling 실전 구현: Tool Use 패턴·오류 처리·보안 설계와 프로덕션 배포 전략
AI Agent의 핵심 기능인 Function Calling과 Tool Use 패턴을 실전 중심으로 구현합니다. OpenAI·Anthropic·LangChain의 도구 호출 API, 오류 처리·재시도 전략, 프롬프트 인젝션 방어, MCP 표준까지 프로덕션 챗봇을 위한 완벽 가이드입니다.
2026-03-12 · 29 분 읽기 #chatbot#function-calling#tool-use#ai-agent#langchain서비스 메시(Service Mesh) 실전 가이드: Istio·Envoy·Linkerd 기반 mTLS·트래픽 관리·가시성 확보
서비스 메시 핵심 개념(데이터 플레인/컨트롤 플레인)부터 Istio 아키텍처(Istiod, Envoy 사이드카), VirtualService·DestinationRule, 트래픽 분할, 서킷 브레이커, mTLS 설정, Linkerd 비교, Ambient Mesh(사이드카리스), 성능 오버헤드 분석, 가시성(Kiali, 분산 추적), 사이드카 인젝션 장애·인증서 로테이션 실패 대응까지 실전 예
2026-03-12 · 17 분 읽기 #architecture#service-mesh#istio#envoy#linkerd멀티턴 대화 관리와 컨텍스트 최적화: LLM 챗봇의 Memory 패턴·대화 요약·Sliding Window 전략
LLM 챗봇에서 멀티턴 대화를 효과적으로 관리하는 메모리 패턴을 다룹니다. Buffer·Summary·Vector Store 메모리, Sliding Window 전략, 대화 요약 기법, 토큰 비용 최적화, LangChain/LlamaIndex 구현, 벡터 DB 기반 영속 메모리, 컨텍스트 드리프트 대응, 프로덕션 아키텍처 패턴을 설명합니다.
2026-03-12 · 28 분 읽기 #chatbot#multi-turn#conversation-management#memory-pattern#context-window분산 락(Distributed Lock) 패턴 비교: Redis Redlock vs ZooKeeper vs etcd — 정합성과 가용성의 트레이드오프
분산 시스템에서 상호 배제를 보장하는 분산 락 구현 패턴을 비교합니다. Redis Redlock 알고리즘과 Martin Kleppmann의 비판, ZooKeeper 임시 순차 노드, etcd Lease 기반 락까지 정합성·가용성·성능 트레이드오프를 실전 코드와 장애 사례로 분석합니다.
2026-03-12 · 28 분 읽기 #architecture#distributed-lock#redis#redlock#zookeeperFeature Store 설계와 운영 가이드: Feast 기반 Online/Offline Store 구축·ML 피처 파이프라인 자동화
Feature Store의 핵심 개념(Online/Offline Serving, Feature Freshness, Point-in-Time Correctness)부터 Feast 아키텍처, Feature 정의와 Entity 설계, Materialization 파이프라인, Online Store 백엔드(Redis, DynamoDB), Offline Store(BigQuery, Redshift),
2026-03-12 · 18 분 읽기 #ai-platform#feature-store#feast#mlops#online-storeKServe 모델 서빙 완벽 가이드: InferenceService·Canary 배포·Transformer·InferenceGraph 프로덕션 운영
KServe를 활용한 Kubernetes 기반 모델 서빙을 다룹니다. InferenceService CRD로 모델 배포, Canary 전략으로 안전한 롤아웃, Transformer로 전후처리 파이프라인, InferenceGraph로 DAG 기반 복합 추론까지 프로덕션 운영 전략을 코드와 함께 구현합니다.
2026-03-12 · 25 분 읽기 #ai-platform#kserve#model-serving#kubernetes#inference-graphRAG 논문 서베이: Retrieval-Augmented Generation의 진화 — RETRO에서 Self-RAG·Corrective-RAG까지
Retrieval-Augmented Generation(RAG) 연구의 진화를 논문 중심으로 추적합니다. 초기 RAG(Lewis et al.)부터 RETRO의 대규모 검색, Self-RAG의 자기 반성, Corrective-RAG의 검색 품질 평가까지 핵심 아키텍처와 벤치마크를 비교 분석합니다.
2026-03-12 · 31 분 읽기 #ai-papers#rag#self-rag#corrective-rag#retroKubernetes Gateway API 실전 가이드: Ingress 대체부터 HTTPRoute·GRPCRoute·Envoy Gateway 프로덕션 배포까지
Kubernetes Gateway API v1.2의 HTTPRoute, GRPCRoute, Envoy Gateway를 활용한 프로덕션 배포 전략을 다룹니다. Ingress에서의 마이그레이션, TLS 종료, 트래픽 분할, 헤더 기반 라우팅, 레이트 리미팅, 모니터링까지 실전 운영 노하우를 제공합니다.
2026-03-12 · 16 분 읽기 #kubernetes#gateway-api#httproute#grpcroute#envoy-gateway