태그: #foundation-models
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 6 편
Gemini Robotics 2와 로봇 파운데이션 모델 — 전신 제어가 실제로 바꾸는 것
2026년 7월 30일 Google DeepMind가 Gemini Robotics 2를 공개하면서 휴머노이드의 발끝부터 손끝까지를 하나의 비전-언어-행동 모델로 제어한다고 발표했습니다. 함께 공개된 숫자는 흥미롭게도 자랑이 아니라 현재 상태의 정직한 기록에 가깝습니다 — 전구를 푸는 데 92퍼센트, 끼우는 데 36퍼센트, 바닥에서 물건을 집는 데 45.7퍼센트. 이 글은 VLA가 실제로 무엇
2026-07-31 · 26 분 읽기 #ai#robotics#vla#foundation-models#evaluation로봇이 보고 듣고 움직이다 — VLA 모델 RT-2와 OpenVLA 리뷰
비전-언어-행동(VLA) 모델은 카메라 영상과 자연어 지시를 받아 로봇의 행동을 직접 출력합니다. RT-2, Open X-Embodiment, OpenVLA를 중심으로 VLA 패러다임의 아이디어, 아키텍처, 액션 토큰화, 강점과 한계를 정리합니다.
2026-06-27 · 29 분 읽기 #ai-papers#robotics#vla#rt-2#openvla모던 Swift & Apple 개발 2026 완벽 가이드 - Swift 6 Strict Concurrency · SwiftData · Foundation Models · SwiftUI 5 · Vapor · TCA 심층 분석
2026년의 Swift는 더 이상 단순한 iOS 언어가 아니다. Swift 6.1은 strict concurrency를 기본으로 켜고, region-based isolation으로 데이터 레이스를 컴파일타임에 잡는다. SwiftData는 iOS 17에서 등장한 뒤 iOS 18의 History API와 composite key 지원으로 Core Data의 자리를 거의 차지했다. Foundati
2026-05-16 · 31 분 읽기 #swift#swift-6#swiftdata#foundation-models#swiftui비전-언어 모델(VLM) 2026 완벽 가이드 - CLIP · LLaVA · InternVL3 · Qwen2.5-VL · GPT-4o · Gemini 2.5 · Claude 4.7 · DINOv2 · SAM 2 · Florence-2 심층 분석
2026년 5월 기준 비전-언어 모델(VLM)의 모든 것을 한 글에 담는다. CLIP 계열(SigLIP, EVA-CLIP)부터 오픈 VLM(LLaVA-NeXT, InternVL3, Qwen2.5-VL, Pixtral, Molmo, Idefics3, MiniCPM-V), 폐쇄형(GPT-4o, Claude 4.7, Gemini 2.5), 비전 파운데이션(DINOv2/v3, SAM 2, Flore
2026-05-16 · 34 분 읽기 #vision-language-models#vlm#clip#llava#internvlLLM 논문 큐레이션 2024-2026 - Llama · DeepSeek · Qwen · Mistral · Phi · RLHF · DPO · CoT · RAG · FlashAttention · vLLM 심층 가이드
LLM을 만들고 운영하는 엔지니어를 위한 2024-2026 필독 논문 30+편 큐레이션. 파운데이션 모델(Llama 3/4, DeepSeek-V3/R1, Qwen3, Mistral, Phi-4, Gemma 3), 학습 혁신(MoE, MLA, GQA), 포스트-트레이닝(RLHF, DPO, ORPO, KTO), 추론(CoT, ToT, GRPO), 에이전트(ReAct, SWE-Agent), 검색(
2026-05-16 · 28 분 읽기 #llm#papers#llama#deepseek#qwen파운데이션 모델 아키텍처 2026 — Transformer 이후 / Mamba 2 / Hyena / RWKV / RetNet / Griffin / Jamba / xLSTM / TTT / DiT / MoE / Flash Attention 3 심층 가이드
2026년 파운데이션 모델 세계는 더 이상 Transformer 일변도가 아니다. Vaswani의 2017년 "Attention is All You Need"는 여전히 표준이지만, 그 옆에 Mamba/Mamba 2 같은 상태공간 모델(SSM), RWKV/RetNet/Griffin 같은 선형 RNN 재발견 진영, AI21 Jamba와 Falcon Mamba 같은 하이브리드, Sepp Hochr
2026-05-16 · 34 분 읽기 #foundation-models#transformer#attention-is-all-you-need#vaswani#mamba