태그: #alphago
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3 편
초인간 게임 AI 2026 — Stockfish 17 / Leela Chess Zero / KataGo / AlphaZero / MuZero / Cicero / Pluribus / AlphaStar / 将棋 dlshogi 심층 가이드
2026년 초인간 게임 AI를 한 글로 정리한다. Stockfish 17(체스 최강), Leela Chess Zero(신경망), Komodo Dragon 3, AlphaZero에서 MuZero로 이어진 DeepMind 계열, Maia(인간 같은 체스), KataGo와 Leela Zero(바둑), AlphaGo(이세돌), Pluribus(6명 포커), Cicero(Diplomacy + 언어),
2026-05-16 · 39 분 읽기 #game-ai#chess-engine#stockfish#leela-chess-zero#lc0개발자의 영화·다큐멘터리 큐레이션 2026 — Social Network·Revolution OS·Aaron Swartz·AlphaGo·Halt and Catch Fire까지, 코드 옆에 두는 화면 한 줄
책장이 판단의 뼈대를, 영상·강의가 그 위의 살을, 팟캐스트·뉴스레터가 흐르는 혈관을 만든다면 영화·다큐는 그 모든 것을 감싸는 공기다. 어느 회사가 어떤 분위기에서 태어났는지, 어느 엔지니어가 어떤 표정으로 결정을 내렸는지 — 글과 코드로는 안 잡히는 톤이 화면에는 남아 있다. 이 글은 2026년 5월 기준으로 개발자라면 한 번은 봐야 할 영화·다큐·드라마·애니메이션을 큐레이션한다. Soc
2026-05-14 · 52 분 읽기 #films#documentaries#developer-culture#tech-history#curation강화학습(Reinforcement Learning) 완벽 가이드: 이론부터 최신 알고리즘, 실전 구현까지
강화학습의 핵심 이론인 MDP, Bellman 방정식부터 Q-Learning, DQN, Policy Gradient, A3C, PPO, SAC까지 주요 알고리즘을 수식으로 유도하고, RLHF, AlphaGo, 로보틱스 응용 사례와 PyTorch 구현 예제를 총정리한다.
2026-03-01 · 69 분 읽기 #reinforcement-learning#deep-learning#dqn#ppo#rlhf