标签: #vit
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 2 篇
计算机视觉完全指南:从 CNN 到 ViT、YOLO、Stable Diffusion
从 ResNet、EfficientNet 等 CNN 架构,到 YOLO 目标检测、SAM 分割、Vision Transformer,直至 Stable Diffusion 生成模型,全面讲解计算机视觉的完整指南。
2026-03-17 · 18 分钟阅读 #computer-vision#cnn#yolo#vit#stable-diffusionVision Transformer(ViT)论文深度解析:一张图像相当于16x16个单词
深度解析Google的ViT论文:将图像转换为patch序列的创新方法、Patch Embedding与Position Embedding的原理、相较CNN的性能与数据效率权衡,以及DeiT、Swin Transformer、BEiT等后续研究的全面梳理。
2026-03-01 · 40 分钟阅读 #vit#vision-transformer#computer-vision#transformer#image-classification