タグ: #AIハードウェア
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 2 件
NPU完全解剖:トランスフォーマーアーキテクチャはシリコン上でいかに動くか
NPUがCPU/GPUと何が異なるのか、トランスフォーマーの各演算がハードウェアにどうマッピングされるのか、そしてLLM推論がなぜメモリバウンドなのかをルーフラインモデルと実際のコードで完全解剖。Apple ANEからQualcomm Hexagon、Groq LPUまで実測値で比較。
2026-03-18 · 21 分で読めます #npu#トランスフォーマー#AIハードウェア#量子化#KVキャッシュGoogle TPU完全解剖:Systolic Arrayが行列乗算をいかに完璧に解くか
Google TPUの核心技術であるSystolic Arrayが行列乗算をどのように極限まで最適化するかを完全解剖。INT8推論からbfloat16、XLAコンパイラ、TPU Podでの分散推論まで、実際の数値とコードで深掘りします。
2026-03-18 · 20 分で読めます #tpu#google#シストリックアレイ#LLMサービング#jax