タグ: #sli
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 4 件
オブザーバビリティ 2026 完全ガイド - OpenTelemetry・Datadog・Grafana スタック(LGTM+Beyla)・Honeycomb・Prometheus・Jaeger・eBPF・SLO 徹底解説
2026年5月時点のプロダクション・オブザーバビリティ・スタックを OpenTelemetry 標準の上で徹底的に俯瞰する。SaaS(Datadog・New Relic・Dynatrace・Splunk・Honeycomb・Coralogix・Logz.io・Chronosphere)、OSS(Grafana LGTM+Beyla・Prometheus+Mimir/Cortex/Thanos・Jaeger・Tempo・Zipkin・Py
2026-05-16 · 26 分で読めます #observability#opentelemetry#datadog#grafana#honeycombObservability 完全ガイド — Metric・Log・Trace・OpenTelemetry・eBPF・SLO (Season 2 Ep 9, 2025)
「観測できなければ運用できない」。Observability はログ収集やモニタリングの上位概念で、unknown unknowns をシステム状態だけから推論する能力である。本稿では Metric・Log・Trace の3軸、Profile を加えた4軸、OpenTelemetry 標準の真価、eBPF によるカーネルレベル観測、SLO・SLI・Error Budget の実戦設計、そして Grafana Stack vs Elast
2026-04-15 · 14 分で読めます #observability#opentelemetry#prometheus#grafana#lokiSLI/SLO/Error Budget基盤の信頼性エンジニアリング実践ガイド
SLI/SLO/Error Budgetを活用した信頼性エンジニアリングの理論と実践を解説します。SLI指標の選定、SLO数値の設定、Error Budgetポリシー、Burn Rateアラート、Prometheusベースの実装まで、プロダクションサービスの信頼性管理パイプライン全体をコードと共に構築します。
2026-03-13 · 19 分で読めます #observability#sli#slo#error-budget#srePrometheus PromQL高度なクエリとRecording Rulesの最適化:SLI / SLOベースの通知スキーム構築ガイド
Prometheus PromQLの高度なクエリパターンからRecording Rulesによるパフォーマンスの最適化、SLI / SLOベースの通知ルールの設計、Alertmanagerルーティング戦略、および大規模な環境運用のトラブルシューティングまでをカバーする包括的なガイド。
2026-03-07 · 41 分で読めます #observability#prometheus#promql#recording-rules#sli