태그: #qwen
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 7 편
LLM 논문 큐레이션 2024-2026 - Llama · DeepSeek · Qwen · Mistral · Phi · RLHF · DPO · CoT · RAG · FlashAttention · vLLM 심층 가이드
LLM을 만들고 운영하는 엔지니어를 위한 2024-2026 필독 논문 30+편 큐레이션. 파운데이션 모델(Llama 3/4, DeepSeek-V3/R1, Qwen3, Mistral, Phi-4, Gemma 3), 학습 혁신(MoE, MLA, GQA), 포스트-트레이닝(RLHF, DPO, ORPO, KTO), 추론(CoT, ToT, GRPO), 에이전트(ReAct, SWE-Agent), 검색(
2026-05-16 · 28 분 읽기 #llm#papers#llama#deepseek#qwen오픈소스 LLM 2026 완벽 가이드 - Llama 4 · DeepSeek V3 + R1 · Qwen 3 · Mistral Large 2 · Phi-4 · Gemma 3 · Falcon 3 심층 분석
2026년 봄, 오픈소스 LLM은 더 이상 폐쇄형의 그림자가 아니다. Meta Llama 4(Scout 109B, Maverick 400B MoE, Behemoth 2T), Llama 3.3 70B 마지막 덴스 베이스라인, DeepSeek V3 671B MoE와 R1 추론 모델, Alibaba Qwen 3와 Qwen 2.5 Coder, Mistral Large 2 123B와 Pixtral·C
2026-05-16 · 55 분 읽기 #open-source-llm#llama-4#deepseek#qwen#mistral중국 AI 랩 2026 — DeepSeek·Qwen·Kimi·GLM·Yi·Doubao·Hunyuan 심층 가이드 (오픈 웨이트의 새로운 무게 중심)
2024년 12월 DeepSeek-V3가 671B MoE를 공개하고 2025년 1월 R1이 reasoning까지 오픈 가중치로 풀었을 때, 세상은 잠시 멈췄다. 그 사이 알리바바 Qwen 3는 235B-A22B로 사실상 오픈 웨이트의 새 기준이 됐고, Moonshot의 Kimi K2는 1T MoE와 long-context로 long-form 챔피언이 됐고, Zhipu의 GLM-4.5는 age
2026-05-15 · 40 분 읽기 #ai#china#deepseek#qwen#alibaba로컬 LLM 시대 완전 가이드: Llama, Qwen, Mistral, vLLM, 양자화, Apple Silicon (2025)
외부 API에 모든 걸 의존하던 시절이 끝나간다. 2025년은 소비자 GPU와 Apple Silicon에서 30B–70B 모델이 "쓸 만하게" 돌아가는 시대. 모델 선택(Llama/Qwen/Mistral/Gemma/Solar), 엔진(vLLM/TGI/SGLang/llama.cpp/Ollama), 양자화(AWQ/GPTQ/EXL2/GGUF), 하드웨어, 비용·전력, 그리고 Privacy-firs
2026-04-15 · 19 분 읽기 #local-llm#llama#qwen#mistral#vllm2025 오픈소스 AI 모델 완전 비교: DeepSeek R1 vs Llama 4 vs Qwen 3 vs Mistral — 누가 왕인가
DeepSeek R1(671B/37B), Llama 4 Scout/Maverick, Qwen 3(235B MoE), Mistral 8x22B — 2025년 오픈소스 AI 모델 4강 완전 비교. 벤치마크, 라이센스, 배포 방법, 비용 분석까지.
2026-03-22 · 32 분 읽기 #open-source#ai#llm#deepseek#llama오픈소스 LLM 완전 정리: Llama 3, Mistral, DeepSeek, Qwen, Gemma 총정리
2024-2026년 오픈소스 LLM 생태계를 완전히 정리하는 가이드. Meta Llama 3, Mistral/Mixtral, DeepSeek V3/R1, Alibaba Qwen, Google Gemma, Microsoft Phi 시리즈를 아키텍처부터 성능, 라이선스, 활용 방법까지 상세히 비교합니다.
2026-03-17 · 21 분 읽기 #llm#llama#mistral#deepseek#qwen오픈소스 LLM 생태계 완전 가이드: 2026년 모델, 도구, 배포 전략
2026년 오픈소스 LLM 생태계를 총망라한 가이드. 주요 모델 패밀리(Llama, Mistral, Gemma, Qwen, DeepSeek), 로컬 추론 도구(Ollama, llama.cpp, vLLM), 파인튜닝 기법(LoRA, QLoRA), 그리고 나만의 LLM을 운영하기 위한 실전 배포 전략을 다룹니다.
2026-03-17 · 32 분 읽기 #open-source#llm#llama#mistral#gemma