태그: #gemma
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 4 편
Diffusion LM의 부상 — 자기회귀의 대안이 될 수 있을까
2026년 6월 구글이 DiffusionGemma를 공개하며 텍스트 확산 모델이 GeekNews와 해커뉴스를 달구고 있습니다. 자기회귀 생성의 구조적 한계, 마스킹 기반 디노이징의 원리, 블록 단위 병렬 생성, 4배 빠르다는 주장의 실체와 품질 트레이드오프까지 비판적으로 분석합니다.
2026-06-12 · 32 분 읽기 #llm#diffusion#text-generation#gemma#inference엣지 AI & TinyML 2026 — LiteRT / ExecuTorch / Edge Impulse / Jetson / Coral / Hailo / Sipeed K230 / llama.cpp / Phi-4 심층 가이드
2026년 엣지 AI / TinyML 생태계의 풀스택 지도 — TFLite Micro 가 LiteRT 로 리브랜드된 후 ExecuTorch 가 GA 가 되며 형성된 듀얼 표준, Edge Impulse 가 만든 TinyML 클라우드 워크플로, NVIDIA Jetson Orin Nano/NX/Thor/AGX 와 Coral Dev Board 의 가속기 격돌, 이스라엘 Hailo-15/8 과 중국
2026-05-16 · 53 분 읽기 #edge-ai#tinyml#tflite-micro#litert#executorch오픈소스 LLM 완전 정리: Llama 3, Mistral, DeepSeek, Qwen, Gemma 총정리
2024-2026년 오픈소스 LLM 생태계를 완전히 정리하는 가이드. Meta Llama 3, Mistral/Mixtral, DeepSeek V3/R1, Alibaba Qwen, Google Gemma, Microsoft Phi 시리즈를 아키텍처부터 성능, 라이선스, 활용 방법까지 상세히 비교합니다.
2026-03-17 · 21 분 읽기 #llm#llama#mistral#deepseek#qwen오픈소스 LLM 생태계 완전 가이드: 2026년 모델, 도구, 배포 전략
2026년 오픈소스 LLM 생태계를 총망라한 가이드. 주요 모델 패밀리(Llama, Mistral, Gemma, Qwen, DeepSeek), 로컬 추론 도구(Ollama, llama.cpp, vLLM), 파인튜닝 기법(LoRA, QLoRA), 그리고 나만의 LLM을 운영하기 위한 실전 배포 전략을 다룹니다.
2026-03-17 · 32 분 읽기 #open-source#llm#llama#mistral#gemma