태그: #ai-infrastructure
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 11 편
데이터센터 인프라 투자 — AI 빌드아웃의 곡괭이와 삽
AI 빌드아웃의 진짜 수혜는 어디에 있을까요. 데이터센터 가치사슬(부동산/REIT, 냉각, 전력, 네트워크, 서버)을 곡괭이와 삽의 관점에서 분석하고, 강세와 약세 양쪽 시각, 사이클 리스크와 체크포인트를 정리합니다.
2026-06-18 · 54 분 읽기 #finance#data-center#ai-infrastructure#reit#cooling전력망·구리·원자재 — AI 전력 빌드아웃의 숨은 수혜
AI 데이터센터 붐은 반도체뿐 아니라 전력망, 구리, 변압기 같은 물리적 인프라 수요를 끌어올리고 있습니다. 이 글은 원자재 사이클과 공급 제약, 인플레 헤지 관점에서 강세와 약세 시각을 균형 있게 살펴봅니다. 정보 제공 목적의 분석이며 투자 권유가 아닙니다.
2026-06-18 · 31 분 읽기 #commodities#copper#power-grid#ai-infrastructure#energy엔비디아 5조 달러 — AI 인프라 사이클은 어디까지 왔나
엔비디아가 시가총액 5조 달러를 사상 처음 돌파했습니다. 이 글은 AI 인프라 자본지출 사이클이 지금 어디쯤 와 있는지를 데이터로 짚고, 강세론과 약세론, 공급망 병목과 리스크를 균형 있게 정리합니다.
2026-06-18 · 16 분 읽기 #finance#nvidia#ai-infrastructure#capex#semiconductorsAI 데이터센터의 전력과 냉각 — 기가와트 시대의 인프라
AI capex 급증과 함께 데이터센터가 기가와트 규모로 커지면서 전력과 냉각이 최대 제약으로 떠올랐습니다. 랙 전력 밀도 급상승, 공랭의 한계와 직접수냉/액침, PUE, 전력망 제약, 칩의 perf/watt 경쟁(Vera Rubin 약 10배 목표)까지 인프라의 큰 그림을 정리합니다.
2026-06-16 · 41 분 읽기 #datacenter#ai-infrastructure#cooling#power#liquid-coolingVector Database 완전 가이드 2025: 임베딩, 유사도 검색, Pinecone/Weaviate/Qdrant/pgvector
Vector DB의 모든 것! 벡터 임베딩 원리, 유사도 검색(코사인/유클리드/내적), 인덱싱 알고리즘(HNSW/IVF/PQ), Pinecone vs Weaviate vs Qdrant vs Milvus vs pgvector 비교, 하이브리드 검색, 필터링, 프로덕션 운영, 성능 벤치마크.
2026-04-13 · 34 분 읽기 #vector-database#embedding#similarity-search#pinecone#weaviateWEKA 고성능 스토리지 완전 가이드 2025: AI/HPC를 위한 병렬 파일시스템
WEKA(WekaFS)의 모든 것! 병렬 파일시스템 아키텍처, NVMe 계층화, GPU Direct Storage, AI/ML 워크로드 최적화, 클라우드(AWS/Azure/GCP) 연동, Ceph/Lustre/GPFS 비교, 데이터 파이프라인, 성능 벤치마크.
2026-03-25 · 34 분 읽기 #weka#wekafs#storage#parallel-filesystem#ai-infrastructureLiteLLM 완전 가이드 2025: 100+ LLM을 하나의 API로 통합하는 프록시 서버
LiteLLM의 모든 것! 100+ LLM 통합 API, OpenAI 호환 프록시 서버, 비용 추적/예산 관리, 로드 밸런싱/폴백, 모델 라우팅, 가상 키, 레이트 리밋, Guardrails, 프로덕션 배포(Docker/K8s).
2026-03-25 · 26 분 읽기 #litellm#llm#api#proxy#openaiScale AI와 데이터 라벨링의 세계: AI 훈련 데이터 산업의 모든 것과 커리어 가이드
Scale AI($14B 기업가치)가 이끄는 AI 훈련 데이터 산업을 완전 분석합니다. 데이터 라벨링의 원리, RLHF 데이터 파이프라인, Scale AI vs Labelbox vs Snorkel 비교, 데이터 품질 관리, 자동 라벨링(Auto-labeling), 그리고 이 분야의 커리어 기회까지.
2026-03-23 · 35 분 읽기 #scale-ai#data-labeling#annotation#rlhf#ai-training-dataAI를 위한 GPU 하드웨어 완전 가이드: 아키텍처부터 선택 기준까지
AI 연구와 학습을 위한 GPU 하드웨어 완전 가이드. NVIDIA GPU 아키텍처(Hopper, Blackwell), Tensor Core, NVLink, HBM 메모리, A100/H100/H200/B200 비교, 클라우드 GPU 옵션까지 상세히 다룹니다.
2026-03-17 · 39 분 읽기 #gpu#hardware#nvidia#cuda#gpu-cudaAI 시스템 설계 완전 가이드: LLM 서비스부터 MLOps 아키텍처까지
AI 시스템을 프로덕션 수준으로 설계하는 완전 가이드. 실시간 추론 시스템, 벡터 검색 인프라, LLM 서비스 아키텍처, 데이터 파이프라인, 모니터링 시스템 설계까지 실전 아키텍처로 배웁니다.
2026-03-17 · 37 분 읽기 #system-design#ai-infrastructure#llm#mlops#architectureSlurm 완전 정복: HPC/AI 클러스터 워크로드 매니저 실전 가이드
Slurm 워크로드 매니저를 완전 정복한다. 아키텍처(slurmctld/slurmd/slurmdbd), 핵심 개념(파티션/QoS/Fairshare), 필수 명령어(sbatch/srun/salloc), GPU 스케줄링(GRES/MIG/MPS), 다중 노드 분산 학습(PyTorch DDP/DeepSpeed/Horovod), 컨테이너 통합(Singularity/Enroot+Pyxis), 설정·모니
2026-03-01 · 17 분 읽기 #slurm#hpc#gpu#distributed-training#cluster