标签: #image-classification
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 2 篇
Vision Transformer(ViT)论文深度解析:一张图像相当于16x16个单词
深度解析Google的ViT论文:将图像转换为patch序列的创新方法、Patch Embedding与Position Embedding的原理、相较CNN的性能与数据效率权衡,以及DeiT、Swin Transformer、BEiT等后续研究的全面梳理。
2026-03-01 · 40 分钟阅读 #vit#vision-transformer#computer-vision#transformer#image-classificationResNet 论文全面解析:残差连接(Residual Connection)如何突破深度学习的深度极限
深入解析 Microsoft 的 ResNet 论文。用公式和代码梳理 Degradation 问题的发现、Skip Connection 的数学原理、Bottleneck 结构、ImageNet ILSVRC 2015 冠军架构,并纵览 ResNet 对现代深度学习产生的影响。
2026-03-01 · 36 分钟阅读 #resnet#residual-learning#cnn#computer-vision#image-classification