태그: #pruning
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 2 편
Edge AI 완전 가이드 2025: 온디바이스 추론, 모델 최적화, TensorRT/ONNX/CoreML
Edge AI의 모든 것! 온디바이스 추론(TensorRT/ONNX Runtime/CoreML/TFLite), 모델 최적화(양자화/프루닝/지식 증류), 하드웨어(NVIDIA Jetson/Apple Neural Engine/Qualcomm NPU), Federated Learning, 프라이버시 보존 AI, 실전 배포.
2026-04-13 · 32 분 읽기 #edge-ai#on-device#inference#tensorrt#onnx지식 증류(Knowledge Distillation) 완전 가이드: 모델 경량화와 압축 기법
지식 증류와 모델 압축 기법을 완전히 마스터하는 가이드. Teacher-Student 학습, 중간 레이어 증류, 관계 기반 증류, 구조적 프루닝, 가중치 공유, 신경망 구조 탐색(NAS)까지 실전 PyTorch 코드로 배웁니다.
2026-03-17 · 32 분 읽기 #knowledge-distillation#model-compression#pruning#deep-learning#ai