タグ: #tensorrt
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 5 件
エッジ AI と TinyML 2026 — LiteRT / ExecuTorch / Edge Impulse / Jetson / Coral / Hailo / Sipeed K230 / llama.cpp / Phi-4 徹底ガイド
2026 年のエッジ AI / TinyML エコシステムをフルスタックで俯瞰 — TFLite Micro が LiteRT へリブランドされ ExecuTorch が GA となって形成された二大標準、Edge Impulse が築いた TinyML クラウドワークフロー、NVIDIA Jetson Orin Nano/NX/Thor/AGX と Coral Dev Board のアクセラレータ対決、イスラエルの Hailo-15/
2026-05-16 · 44 分で読めます #edge-ai#tinyml#tflite-micro#litert#executorchEdge AI完全ガイド2025: オンデバイス推論、モデル最適化、TensorRT/ONNX/CoreML
Edge AIのすべて!オンデバイス推論(TensorRT/ONNX Runtime/CoreML/TFLite)、モデル最適化(量子化/プルーニング/知識蒸留)、ハードウェア(NVIDIA Jetson/Apple Neural Engine/Qualcomm NPU)、連合学習、プライバシー保護AI、実践デプロイ。
2026-04-13 · 27 分で読めます #edge-ai#on-device#inference#tensorrt#onnxAIモデルサービングと推論最適化完全ガイド: vLLM、TensorRT、Triton、Ollama
本番環境でAIモデルを効率的にサービングするための完全ガイド。vLLM、TensorRT、NVIDIA Triton推論サーバー、Ollama、量子化(INT8/INT4)、バッチ処理、レイテンシ最適化を実例とともに完全習得。
2026-03-17 · 22 分で読めます #mlops#model-serving#vllm#tensorrt#tritonSlurm 完全攻略:HPC/AI クラスター ワークロードマネージャー実践ガイド
Slurm ワークロードマネージャーを完全攻略する。アーキテクチャ(slurmctld/slurmd/slurmdbd)、中核概念(パーティション/QoS/Fairshare)、必須コマンド(sbatch/srun/salloc)、GPU スケジューリング(GRES/MIG/MPS)、マルチノード分散学習(PyTorch DDP/DeepSpeed/Horovod)、コンテナ統合(Singularity/Enroot+Pyxis)、設定
2026-03-01 · 18 分で読めます #slurm#hpc#gpu#distributed-training#cluster自律走行/ロボティクス技術スタック完全攻略:C++、ROS2、CUDA、TensorRTからVLM/VLA、シミュレーションまで
自律走行とロボティクスの中核技術スタックを総まとめする。Modern C++、ROS/ROS2、CUDA並列プログラミング、TensorRT最適化、モデル軽量化(量子化/プルーニング)、センサーフュージョン(GPS/IMU/カメラ/LiDAR)、VLM/VLAモデル、SIL/HILテスト、シミュレーション(CARLA/Isaac Sim)、自律走行フルスタック、VR/ARデジタルツイン、クラウドインフラまで、13の中核領域を実践的な観点
2026-03-01 · 27 分で読めます #autonomous-driving#robotics#ros2#cuda#tensorrt