태그: #onnx
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 2 편
Edge AI 완전 가이드 2025: 온디바이스 추론, 모델 최적화, TensorRT/ONNX/CoreML
Edge AI의 모든 것! 온디바이스 추론(TensorRT/ONNX Runtime/CoreML/TFLite), 모델 최적화(양자화/프루닝/지식 증류), 하드웨어(NVIDIA Jetson/Apple Neural Engine/Qualcomm NPU), Federated Learning, 프라이버시 보존 AI, 실전 배포.
2026-04-13 · 32 분 읽기 #edge-ai#on-device#inference#tensorrt#onnx엣지 AI와 온디바이스 ML 완전 가이드: TFLite, ONNX, Core ML, llama.cpp
엣지 디바이스에서 AI 모델을 실행하는 완전 가이드. TensorFlow Lite, ONNX Runtime, Core ML, MediaPipe, llama.cpp, Whisper.cpp까지 모바일과 엣지 환경에서 최적화된 AI 배포 방법을 실전으로 배웁니다.
2026-03-17 · 35 분 읽기 #edge-ai#on-device-ml#tflite#onnx#core-ml