タグ: #controller-runtime
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 6 件
Operator の可観測性 — メトリクス、イベント、ロギング、そして SLO
Kubebuilder ベースの Operator の可観測性を、メトリクス、イベント、ロギング、トレーシング、status/conditions、そして SLO の観点から深く掘り下げます。controller-runtime のデフォルトメトリクスの意味から、カスタムメトリクスの追加、Prometheus/Grafana 連携、アラートルール、reconcile が動かないときのデバッグランブックまで、実践的なコードとともに整理しま
2026-06-15 · 30 分で読めます #kubernetes#operator#observability#prometheus#controller-runtimeCRD なしのコントローラ — 既存リソースを自動化するパターン
すべての自動化に CRD が必要なわけではありません。ビルトインリソースを watch するコントローラだけで、ConfigMap/Secret 同期、ネームスペースのブートストラップ、ノードラベリングといった社内運用を自動化できます。controller-runtime で CRD なしに実装するコード、Operator と単純コントローラの区別、admission webhook のポリシー、そして権限やループといった落とし穴を扱い
2026-06-15 · 21 分で読めます #kubernetes#controller#controller-runtime#automation#client-goデータベースOperatorを作る — バックアップ・フェイルオーバー・スケールをコードで
ステートフルなデータベース運用の難しさをreconcileループで解いていく過程をコードで追います。CRスペック設計からStatefulSet・Service・PVCの調整、定期バックアップ、フェイルオーバーとリーダー選出の概念、順次ローリングアップグレード、statusによるヘルス公開と観測までを扱います。既存Operatorを参考にしつつ自作のトレードオフと落とし穴も押さえます。
2026-06-15 · 22 分で読めます #kubernetes#operator#database#kubebuilder#controller-runtimeOperator の本番アップグレードとマイグレーション — 無停止で進化させる
Operator を本番環境で安全にアップグレードする全体の流れを解説します。リーダー選出を伴うコントローラ Deployment のローリング、マルチバージョン CRD と conversion webhook、管理ワークロードの段階的ロールアウト、ロールバック戦略、大規模 CR マイグレーション、障害対応までを動作するコードとともにまとめました。
2026-06-15 · 34 分で読めます #kubernetes#operator#kubebuilder#controller-runtime#crdReconcile ループ深掘り — 冪等性、エラー処理、キュー、そして性能
reconcile リクエストの流れ(informer→workqueue→reconcile)、Result と requeue、冪等実装パターン、status と conditions、predicate によるイベントフィルタ、レート制限と並行性、キャッシュとクライアント、観測、よくあるバグ、性能チューニングまで reconcile ループを深く解剖します。
2026-06-15 · 31 分で読めます #kubernetes#operator#reconcile#controller-runtime#performanceKubebuilder で初めての Operator を作る — プロジェクト作成からデプロイまで
Kubebuilder で実際に動く Operator を最初から最後まで作ります。事前準備、init/create api の流れ、API 型の定義、Deployment と Service を調整する reconcile の全コード、RBAC マーカー、CRD 生成、ローカル実行とクラスターデプロイ、テストの概念、よくある間違いまで扱います。
2026-06-15 · 15 分で読めます #kubernetes#kubebuilder#operator#controller-runtime#go