태그: #accelerator
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3 편
Systolic Array와 Dataflow 아키텍처 — TPU의 심장 원리
AI 가속기의 핵심 연산인 행렬곱을 효율적으로 처리하는 systolic array의 동작 원리를 ASCII 다이어그램과 함께 깊이 파헤칩니다. weight-stationary와 output-stationary 같은 dataflow 전략, 데이터 재사용과 에너지, 텐서코어와의 비교, 컴파일러 매핑까지 TPU의 심장 원리를 정리합니다.
2026-06-16 · 38 분 읽기 #gpu-cuda#systolic-array#dataflow#tpu#ai-hardware2026 AI 가속기 지형 — Blackwell에서 Vera Rubin까지
2026년 AI 가속기 시장을 한눈에 정리합니다. NVIDIA Blackwell과 차세대 Vera Rubin, AMD MI350X, 추론 capex가 학습을 처음 추월한 변화, 그리고 워크로드별로 어떤 칩을 골라야 하는지 개발자 관점에서 살펴봅니다.
2026-06-16 · 40 분 읽기 #ai-hardware#nvidia-blackwell#vera-rubin#inference#gpuAI 하드웨어 가속기 2026 — NVIDIA Blackwell / AMD Instinct MI400 / Google TPU Trillium / Cerebras WSE-3 / Groq LPU / Tenstorrent / Etched Sohu / Furiosa / Rebellions 심층 가이드
2026년 AI 하드웨어는 더 이상 NVIDIA 한 곳의 이야기가 아니다. Blackwell(B100/B200/GB200 NVL72/B300)이 GTC 2024에서 등장하고, 2026년 9월 Rubin이 예고된 가운데 AMD Instinct는 MI300X에서 MI355X를 거쳐 MI400 Helios까지 진격했다. Intel Gaudi 3가 마지막 별도 라인으로 출하되고 Falcon Shor
2026-05-16 · 27 분 읽기 #ai-hardware#gpu#accelerator#nvidia-blackwell#b100