태그: #vision-transformer
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 2 편
CNN 아키텍처 완전 정복: LeNet부터 EfficientNet, Vision Transformer까지
CNN 아키텍처의 역사와 발전을 완전히 이해하는 가이드. LeNet, AlexNet, VGG, ResNet, DenseNet, EfficientNet, Vision Transformer까지 구조 분석과 PyTorch 구현으로 완벽히 마스터합니다.
2026-03-17 · 32 분 읽기 #cnn#computer-vision#deep-learning#resnet#vggVision Transformer(ViT) 논문 완벽 분석: 이미지 한 장은 16x16 단어의 가치가 있다
Google의 ViT 논문을 심층 분석한다. 이미지를 패치 시퀀스로 변환하는 혁신적 접근, Patch Embedding과 Position Embedding의 원리, CNN 대비 성능과 데이터 효율성 트레이드오프, 그리고 DeiT, Swin Transformer, BEiT 등 후속 연구까지 총정리한다.
2026-03-01 · 45 분 읽기 #vit#vision-transformer#computer-vision#transformer#image-classification