블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3672 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 260#career 233#ai 220#llm 216#devops 195#2026-04 158#security 147#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 66#cs-fundamentals 63#rag 63#systems 63#python 55#learning 54#self-improvement 53
웹 에이전트는 웹페이지의 글을 명령으로 읽는다 — 교차 사이트 프롬프트 인젝션과 Prismata의 봉쇄
2026년 7월 9일 arXiv에 올라온 Prismata 논문(Villa, Ozdarendeli, Tan, Popa)은 자율 웹 에이전트의 가장 오래된 약점을 다룹니다. 에이전트는 자연어를 명령으로 해석하기 때문에, 페이지에 섞인 제3자·사용자 생성 콘텐츠가 그대로 에이전트를 탈취할 수 있습니다. 저자들은 이를 Cross-Site Scripting의 재림으로 봅니다. Prismata는 신뢰를
2026-07-11 · 11 분 읽기 #prompt-injection#web-agents#ai-security#least-privilege#browser-agents확산 LLM이 CUDA 커널을 쓴다 — DICE와 왜 병렬 생성이 도움이 되는가
DICE는 2026년 2월 프리프린트로, 확산(diffusion) 대규모 언어 모델이 CUDA 커널 생성에서 같은 규모의 자기회귀(autoregressive) 모델을 능가하고 새로운 최고 성능(SOTA)을 세웠다고 주장합니다. 핵심 아이디어는 토큰을 왼쪽에서 오른쪽으로 하나씩 쓰는 대신, 전체 시퀀스를 병렬로 생성하고 어느 위치든 비순차적으로 고쳐 쓸 수 있다는 것 — 전역 구조가 중요한 코
2026-07-11 · 12 분 읽기 #ai#llm#diffusion#cuda#gpu군 복무 이후의 BTS: 「아리랑」 앨범·투어로 읽는 컴백의 규모와 무대 설계
BTS가 전원 병역을 마친 뒤 그룹으로 처음 낸 정규 「아리랑」은 2026년 3월 20일 발매돼 빌보드 200에 첫 주 641,000 앨범 환산 판매량으로 1위 데뷔했고, 통산 7번째이자 2022년 「Proof」 이후 첫 1위이며 3주 연속 정상을 지켰습니다. 같은 이름의 아리랑 월드투어는 2026년 4월 9일 고양에서 시작해 34개 도시·23개국에서 88회가 넘는 공연으로 2027년까지 이
2026-07-11 · 11 분 읽기 #kpop#bts#music#korea#touring개발자들이 GitHub을 떠나 Codeberg로 가는 이유 — 그리고 떠날 때 실제로 잃는 것
GitHub을 떠나 Codeberg·Forgejo·자체 호스팅으로 옮겼다는 글이 부쩍 늘었습니다. Ghostty, Zig, Gentoo의 이탈, 잦은 장애, Microsoft의 CoreAI 편입, 2026년 4월 AI 학습 기본값 전환이 배경입니다. 이 글은 실제 1차 자료를 근거로 무엇이 사람들을 움직이는지, Codeberg와 Forgejo가 실제로 무엇을 주는지, 그리고 GitHub을 떠
2026-07-11 · 11 분 읽기 #github#codeberg#forgejo#self-hosting#open-source스텝마다 얼마나 생각할지 고르기 — Ares의 적응형 추론 노력 라우팅
Ares(2026년 3월 프리프린트)를 실무 관점에서 정리했습니다. 이 논문은 추론 노력을 태스크 전체가 아니라 스텝 단위의 비용 레버로 다룹니다. 가벼운 라우터가 상호작용 이력을 보고 각 스텝에 필요한 가장 낮은 추론 레벨을 예측해, 모든 스텝을 최대 노력으로 돌리는 낭비를 줄입니다. 저자들은 TAU-Bench·BrowseComp-Plus·WebArena에서 추론 토큰을 최대 52.7%까지
2026-07-11 · 8 분 읽기 #ai#agents#llm#efficiency애플이 오픈AI를 고소했다 — 인재 이동과 영업비밀법, 개발자가 읽는 법
2026년 7월 10일 애플이 오픈AI와 전직 직원 두 명, 그리고 오픈AI의 하드웨어 자회사 io Products를 캘리포니아 북부지방법원에 제소했습니다. 영업비밀 유용과 계약 위반이 골자입니다. 이 글은 애플이 "주장"하는 내용을 주장으로 분명히 구분해 정리하고, 이 소송의 진짜 쟁점 — 캘리포니아에서 경업금지 약정이 무효이기에 영업비밀법이 인재 이동을 규율하는 거의 유일한 지렛대라는 점
2026-07-11 · 11 분 읽기 #openai#apple#trade-secrets#legal#industry테슬라 FSD v14 라이트가 한국에 왔다 — 구형 HW3에 모델을 "증류"해 넣기, 그리고 "감독형"이라는 정직한 이름
2026년 7월 10일 테슬라코리아가 FSD(감독형) v14 라이트를 국내 배포하기 시작했습니다. 대상은 미국산 모델3·모델Y 중 구형 HW3 컴퓨터를 단 차량뿐입니다. 이 글은 "라이트"가 마케팅 등급이 아니라 상위 HW4 모델을 구형 하드웨어로 증류해 넣은 결과라는 점, 한국이 캐나다·유럽보다 먼저 받은 게 왜 흥미로운지, 그리고 이름과 달리 이것이 여전히 운전자 책임의 레벨 2 보조라는
2026-07-11 · 12 분 읽기 #tesla#fsd#autonomous-driving#adas#hw3Rust 1.97.0이 나왔다 — 마침 그 cargo로 쿠버네티스 오퍼레이터를 빌드하던 참이었다
Rust 1.97.0이 2026년 7월 9일에 stable로 릴리스됐습니다. 이 글은 릴리스 노트에서 실제로 바뀐 세 가지 — v0 심볼 맹글링의 stable 승격, Cargo의 경고 거부(deny warnings), 그동안 숨어 있던 링커 출력의 기본 노출 — 을 정리하고, 며칠 전 바로 그 cargo 1.97로 쿠버네티스 GPU 오퍼레이터를 빌드했던 실측 경험과 겹쳐 봅니다. 정직한 결론
2026-07-11 · 8 분 읽기 #rust#rust-1.97#release-notes#cargo#kube-rs2026년에도 윤초는 없다 — 그리고 아무도 겪어본 적 없는 음의 윤초
IERS가 2026년 7월 6일 Bulletin C 72로 "2026년 12월 말 윤초 없음"을 발표했습니다. 겉보기엔 조용한 소식이지만, 지구 자전이 2016년부터 오히려 빨라지면서 사상 처음으로 음의 윤초를 넣어야 할 가능성이 생겼습니다. 윤초가 무엇인지, POSIX 시간이 왜 이걸 표현하지 못하는지, 2012년과 2017년의 실제 장애가 무엇을 가르쳐 주는지, 그리고 한 번도 실행된 적
2026-07-11 · 10 분 읽기 #leap-second#utc#ntp#distributed-systems#posix-timeKubeVirt GPU 패스스루 VM은 왜 112일간 스케줄되지 못했나 — 실제 클러스터 부검
Rust 오퍼레이터가 "GPU 노드 4개 전부 NotReady"라는 진단을 내린 뒤, 그 죽음의 원인을 실제 8노드 클러스터(GPU Operator v25.3.0, KubeVirt v1.7.0)에서 끝까지 추적했습니다. gpu-fedora와 rhel9-gpu-vm이 112일간 ErrorUnschedulable로 멈춰 있던 진짜 이유는 화려한 GPU 설정이 아니라 kubelet 한 줄 에러 —
2026-07-11 · 8 분 읽기 #kubevirt#gpu#kubernetes#nvidia#devops느린 컴퓨터에서 GLM-5.2 돌리기 — colibrì가 744B 모델을 디스크에서 스트리밍하는 법
colibrì는 순수 C 약 1,300줄로 작성된 추론 엔진으로, 744B(7,440억) 파라미터 MoE 모델인 GLM-5.2를 램 25GB짜리 소비자용 PC에서 돌립니다. 핵심은 MoE 희소성과 디스크 스트리밍입니다 — 밀집 레이어 약 9.9GB만 램에 상주시키고, 약 370GB의 라우팅 전문가는 NVMe SSD에 두고 토큰마다 필요한 것만 읽습니다. 대가는 정직하게 느립니다: 콜드 상태
2026-07-11 · 8 분 읽기 #ai#llm#local-inference#moe#quantization보편 개념으로서의 계산 — 무엇이 단단하고 무엇이 과장인가
Tim Roughgarden이 가르치는 '보편적이고 근본적인 개념으로서의 계산' 강의가 화제입니다. 실제 내용은 정지 문제, 알고리즘 효율, NP-완전성, 그리고 P 대 NP를 다루는 견실한 계산 이론입니다. 이 글은 그 단단한 핵심과, 우주나 마음이 문자 그대로 계산이라는 더 큰 주장을 구분하고, '모든 것은 계산이다'가 어디서부터 반증 불가능한 말이 되는지를 따집니다.
2026-07-11 · 14 분 읽기 #computer-science#computation#complexity#theory#philosophyACSM 피트니스 트렌드 20년 — 미용에서 정신건강·수명·데이터로
미국스포츠의학회(ACSM)의 세계 피트니스 트렌드 설문이 올해로 20회를 맞았고, 2026년 1위는 다시 웨어러블 기술입니다. 이 글은 상위 10개를 정리하되 순위 자체보다 20년이 그린 궤적을 읽습니다 — "체중 감량"이 "체중 관리"로 이름을 바꾸고, 운동하는 사람의 78%가 정신적·정서적 안녕을 가장 큰 이유로 꼽는 변화. 이것이 약 2,000명의 전문가가 답한 인식 조사이지 대중 행동
2026-07-11 · 12 분 읽기 #fitness#health#trends#wellness#wearablesAI 코딩 모델 평가에서 신호와 잡음 가려내기 — SWE-bench가 흔들리는 이유
OpenAI 평가팀은 가장 널리 쓰이는 코딩 벤치마크인 SWE-bench Verified가 오염과 설계 결함 탓에 더 이상 의미 있는 신호를 주지 못한다고 밝혔습니다. 신호(모델을 가려내는 힘)와 잡음(실행마다 흔들리는 변동)이라는 두 축으로 다시 보면, 리더보드 순위의 상당수가 잡음 위에 서 있습니다. 오염·하네스 차이·채점 불가능한 과제·과적합이 어떻게 점수를 부풀리는지 정리하고, 팀이
2026-07-11 · 12 분 읽기 #llm-evaluation#coding-benchmarks#swe-bench#benchmarks#ai-codingRust로 쿠버네티스 GPU 오퍼레이터 만들기 — kube-rs로 실제 클러스터를 진단하다
8노드 실운영 홈랩 클러스터(k8s v1.32.5)를 상대로, kube-rs를 써서 GPU 오퍼레이터를 Rust로 직접 만들어 돌렸습니다. GpuInventory 커스텀 리소스를 정의하고, 두 개의 컨트롤러(노드 스캔→CR 상태 기록, 노드 감시→ConfigMap 갱신)를 한 바이너리로 띄워 클러스터 밖에서 실행했습니다. 그리고 오퍼레이터가 실제로 뱉은 결과 — GPU 노드 4개 중 Read
2026-07-11 · 10 분 읽기 #rust#kubernetes#operator#gpu#kube-rs프로덕션 RAG 패턴 — 순진한 RAG가 실패하는 이유와 실제로 통하는 기법들
데모용 RAG는 30분이면 만들지만, 프로덕션에서 조용히 무너지는 지점은 대부분 생성이 아니라 검색입니다. 청킹, 임베딩과 하이브리드 검색(BM25 + 벡터), 리랭킹, 컨텍스추얼 리트리벌, 쿼리 재작성, 그리고 평가를 각각 무엇이고·언제 도움이 되며·무엇을 대가로 치르는지 정리합니다. Anthropic의 컨텍스추얼 리트리벌 수치처럼 출처 있는 숫자만 인용하고, RAG가 마법이 아니라는 점과
2026-07-11 · 18 분 읽기 #ai#rag#llm#retrieval#embeddingsForward Deployed Engineer(FDE)를 준비하며 — 필요한 소프트웨어 지식 지도
Forward Deployed Engineer(FDE)는 Palantir이 만든 직군으로, 엔지니어가 고객사에 직접 들어가 제품을 그들의 실제 환경에 배포·통합하는 역할입니다. 최근 OpenAI·Anthropic 같은 AI 회사들이 자사 모델을 고객 인프라에 얹기 위해 이 직군을 대거 채용하며 다시 주목받고 있습니다. 이 글은 FDE를 준비하는 사람을 위해, 역할의 실체(실제 소스 기반)와
2026-07-11 · 12 분 읽기 #career#fde#software-engineering#palantir#solutions-engineering자동화의 세 부족 — Zapier·Make·n8n, RPA, 그리고 2026 에이전틱 자동화
"이거 자동화해 줘"라는 말 앞에서 사람들은 자주 엉뚱한 도구를 집습니다. 자동화에는 서로 다른 세 부족이 있기 때문입니다 — API를 잇는 워크플로 자동화(Zapier·Make·n8n), API가 없는 화면을 사람처럼 조작하는 RPA(UiPath·Power Automate), 그리고 판단까지 대신하는 AI 에이전트. 각 부족의 정체와 2026년 지형(과금 모델의 함정, n8n 2.0의 AI
2026-07-09 · 11 분 읽기 #automation#rpa#zapier#n8n#ai-agentsLLM 학습 데이터 전처리 완전 가이드 — 웹 크롤부터 토큰 패킹까지, 최신 논문과 함께
좋은 모델은 좋은 데이터에서 나오고, 좋은 데이터는 전처리 파이프라인에서 나옵니다. 웹 크롤 수집 → 본문 추출 → 언어 식별 → 휴리스틱·분류기 품질 필터링 → 정확·근사(MinHash) 중복 제거 → PII·독성 처리 → 벤치마크 오염 제거 → 토크나이즈와 시퀀스 패킹까지 사전학습 데이터의 전체 공정을 단계별로 설명하고, SFT 데이터 정제의 요점, datatrove·Dolma·NeMo
2026-07-09 · 13 분 읽기 #ai#llm#data-engineering#preprocessing#trainingKeycloak로 SSO 구축하기 — Realm·Client·플로우부터 2026 신기능까지
사내 앱 20개에 로그인을 각각 붙이는 대신, 하나의 아이덴티티 서버가 전부를 대신하게 만드는 것이 SSO입니다. 오픈소스 표준인 Keycloak을 Realm·Client·Role·Identity Provider라는 4개의 핵심 개념으로 이해하고, OIDC Authorization Code + PKCE 로그인 흐름을 한 단계씩 따라가며, Quarkus 배포의 build/start 2단계 모델
2026-07-09 · 16 분 읽기 #keycloak#sso#oidc#security#devops