タグ: #opentelemetry
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 37 件
Langfuse SDK計測 — 何が自動で取れて何を手で入れるか
トレースを作る作業はSDKを入れることではなく、境界を引くことです。本記事はLangfuse Python SDK v4を基準に、デコレータ、コンテキストマネージャ、手動生成という三つの計測方式が何を違えているのかを整理し、属性を下へ流すpropagateattributesがなぜ必要か、OpenAIやLangChainのようなフレームワーク統合が自動で取ってくれる範囲はどこまでかを押さえます。v4で取り込み経路がOpenTelemet
2026-08-14 · 14 分で読めます #observability#langfuse#llm-tracing#instrumentation#opentelemetryLangfuseトレーシングのデータモデル — trace、observation、scoreが一度の実行を収める形
Langfuseの画面を先に見ても、何を見ているのかは分かりません。本記事はLangfuseが収集するデータの形から整理します。traceが何をまとめ、observationがspan・generation・eventに分かれる基準は何か、sessionとuserがtraceの上にどんな層として乗るのか、scoreがどこに付くのかを公式ドキュメントで確認します。RAGの一回の呼び出しとエージェントの一回の実行がそれぞれどんなツリーとして
2026-08-14 · 14 分で読めます #observability#langfuse#llm-tracing#data-modeling#opentelemetryいま注目のオープンソース (4) オブザーバビリティとセキュリティ
観測データは量がそのままコストになり、セキュリティツールはパイプラインに入り込めなければ使われません。計装の標準、ストレージエンジン、eBPF ベースのランタイム監視、サプライチェーンの検証まで、実際に定着したオープンソース 12 個を、スター数の順位ではなく担当する層ごとにまとめて紹介します。何を置き換えるのか、成熟度はどの程度か、いつ使うべきでないのかも併せて書きました。リポジトリのパスとライセンス、スター数、最新のプッシュは 20
2026-08-12 · 9 分で読めます #open-source#observability#security#opentelemetry#ebpf観測データをClickHouseに入れるということ — スキーマ、ロールアップ、TTL、そして役割分担
トレースとログが一日数TB規模に膨らむと、検索エンジンや時系列DBひとつでは持ちこたえられなくなります。ClickHouseが観測データに合っている理由をカラム指向ストレージと圧縮、ソートキーの観点から整理し、トレースとログのテーブルを実際のDDLで設計します。属性をMapで持つかJSON型で持つかの判断基準、マテリアライズドビューでロールアップを作る方法、パーティショニングとTTLでコストを制御する方法を扱います。最後に、Promet
2026-08-02 · 25 分で読めます #observability#clickhouse#opentelemetry#data-modeling#costアプリケーションにOpenTelemetryを付ける — 自動計測から手動スパンまで、そしてコレクタを置く理由
計測はSDKをインストールする作業ではなく、順序を守る作業です。自動計測で1日で骨格を立て、リソース属性を先に確定させたうえで、self timeが大きい区間にだけ手動スパンを入れる順序を、実際のサービスひとつを最後まで計測しながら示します。コンテキスト伝播が途切れる四つの地点、スレッドプール、メッセージキュー、バックグラウンドジョブ、ヘッダーを消すプロキシをそれぞれ再現して直します。最後にコレクタをアプリとバックエンドの間に置く理由を
2026-08-02 · 24 分で読めます #observability#opentelemetry#instrumentation#otel-collector#tracing分散トレーシングが実際に答える問い — スパン、サンプリング、そしてどこで時間が消えたのか
「遅い」という報告は来るのに、十個のサービスのどれが犯人か分からないときに必要なのがトレーシングです。トレースとスパン、コンテキスト伝播の構造から始めて、ログとメトリクスでは原理的に答えられない問いが何かを整理します。自動計装がカバーする範囲と手動スパンを必ず入れるべき地点、ヘッドサンプリングがなぜ必要なトレースを優先的に捨てるのか、テールサンプリングがそれをどう解いて代わりに何を支払うのかを、コレクターの設定とともに扱います。メッセー
2026-07-26 · 24 分で読めます #observability#distributed-tracing#opentelemetry#tail-sampling#performance構造化ロギングの設計 — 障害が起きたときに実際に役立つログを作る
障害の真っ只中でログをgrepして諦めた経験があるなら、ログ設計が間違っています。人が読むログと機械が読むログを分離し、すべての行に必ず入れるべきフィールドを決め、ログレベルを判断するたったひとつの基準を立てる方法を扱います。W3Cのtraceparentでサービス境界を越えてリクエストを追う方法、個人情報とシークレットを取り除くマスキング設定、物語が途切れないリクエスト単位のサンプリング、そしてカーディナリティとコストの計算までを実際
2026-07-26 · 19 分で読めます #observability#logging#structured-logging#opentelemetry#incident-responseOTelのKubernetes属性がstableになった — k8sattributesのデフォルトが反転する前にすべきこと
OpenTelemetryのKubernetesセマンティック規約は、2026年6月12日のsemconv v1.42.0でstableに昇格しました。ところがCollectorのk8sattributesプロセッサはいまだデフォルトが旧スキーマ(v0)のままなので、大半の人には何も起きていません。問題はこれが恒久的ではないという点です — Collector RFCが定めたロールアウトどおりなら、フィーチャーゲートがbetaに上がった
2026-07-16 · 22 分で読めます #opentelemetry#observability#kubernetes#semantic-conventions#telemetry-pipelineオブザーバビリティ徹底解説:ログ・トレーシング・LLM監視
ログ・メトリクス・トレースという三本柱から、それらがtraceidでどう結びつくか、LokiとOpenSearchのログ戦略の違い、OpenTelemetryを中心とした分散トレーシング(Jaeger・Tempo)、そしてLangfuseに代表されるLLMオブザーバビリティまで。実務でスタックをどう組み、何を選ぶべきかを一つずつ対比して整理します。
2026-07-03 · 24 分で読めます #observability#opentelemetry#tracing#logging#llmオブザーバビリティ 2026 完全ガイド - OpenTelemetry・Datadog・Grafana スタック(LGTM+Beyla)・Honeycomb・Prometheus・Jaeger・eBPF・SLO 徹底解説
2026年5月時点のプロダクション・オブザーバビリティ・スタックを OpenTelemetry 標準の上で徹底的に俯瞰する。SaaS(Datadog・New Relic・Dynatrace・Splunk・Honeycomb・Coralogix・Logz.io・Chronosphere)、OSS(Grafana LGTM+Beyla・Prometheus+Mimir/Cortex/Thanos・Jaeger・Tempo・Zipkin・Py
2026-05-16 · 26 分で読めます #observability#opentelemetry#datadog#grafana#honeycombネットワーク & サービスオブザーバビリティ 2026 完全ガイド — eBPF · Cilium Hubble · Pixie · Pyroscope · Grafana Loki + Tempo + Mimir · Netdata · OpenTelemetry 深掘り
2026年のオブザーバビリティはメトリクス・ログ・トレース・プロファイルの4本柱と、eBPFによる自動計装が標準である。Cilium Hubble、Pixie、Pyroscope、Grafana LGTMスタック、Netdata、OpenTelemetryまで — 何をいくらでどこに使うかを一枚の地図にまとめる。韓国NCsoft、Coupang、Naver、Kakaoと日本Mercari、LINE Yahoo、CyberAgentの導入
2026-05-16 · 27 分で読めます #observability#ebpf#cilium-hubble#pixie#pyroscopeKubestronaut ロードマップ 2026 完全ガイド - CKA・CKAD・CKS・KCNA・KCSA と CNCF 認定資格ラダー(Prometheus・Istio・Cilium・OpenTelemetry・Argo)徹底解説
2026年5月時点の Kubestronaut プログラムと CNCF 認定資格ラダーを最後まで読み解く。主要5試験(CKA・CKAD・CKS・KCNA・KCSA)の出題範囲、試験形式、合格点、合格率、Killer Shell 模試、KodeKloud・A Cloud Guru・Linux Foundation Training、Golden Kubestronaut、アソシエイト系(PCA・ICA・CAPA・OTCA・CGOA・CCS
2026-05-16 · 27 分で読めます #kubestronaut#cncf#kubernetes#cka#ckadエラートラッキング & モニタリング 2026 — Sentry / Bugsnag / Honeybadger / GlitchTip / Highlight / LogRocket / Hyperdx 徹底比較
2026年のエラートラッキング/モニタリング全体マップを一気に整理 — 2024年に Codecov を買収して AI グルーピングと Replay を標準機能に引き上げた事実上のリーダー Sentry、SmartBear 傘下でエンタープライズとコンプライアンスに振った Bugsnag、一人のインディー開発者でも気軽に使える Honeybadger、Sentry SDK 互換でセルフホスト可能なオープンソース GlitchTip、セッ
2026-05-16 · 25 分で読めます #error-tracking#monitoring#sentry#bugsnag#honeybadger分散トレーシング & OpenTelemetry 2026 — OTel / Jaeger / Tempo / Zipkin / Honeycomb / Lightstep / SigNoz / SkyWalking / Datadog APM 徹底比較
2026年、分散トレーシングは OpenTelemetry に収束した。OTel 仕様と Collector、W3C Trace Context と B3 伝搬、Jaeger / Tempo / Zipkin といった OSS バックエンド、Honeycomb / SigNoz の observability 2.0 陣営、Lightstep と Datadog / New Relic / Dynatrace といった APM 巨人、P
2026-05-16 · 29 分で読めます #observability#distributed-tracing#opentelemetry#otelcol#jaegereBPF 観測性 2026 — Pixie / Parca / Cilium Hubble / Tetragon / Beyla / Coroot / Falco 徹底ガイド
2026 年時点の eBPF エコシステムを一気にまとめる。Pixie、Parca、Cilium Hubble、Tetragon、BCC/bpftrace、OpenTelemetry eBPF Collector、Grafana Beyla、Coroot、Inspektor Gadget、Kepler、Falco を比較し、CO-RE 革命と Windows/macOS への移植まで扱う。
2026-05-15 · 33 分で読めます #ebpf#observability#pixie#parca#ciliumOpenTelemetry 2026 深掘り — OTLP・セマンティック規約・Collector パイプライン・自動計装、標準化戦争が終わった場所から
OpenTelemetry はもはや「競合する選択肢の一つ」ではない。2026年5月時点、OTLP は主要な可観測性ベンダー全てが受け取る単一プロトコルとなり、HTTP・リレーショナル DB・メッセージングのセマンティック規約 v1 は stable で固まった。ログは GA、Profiles は第四のシグナルとして位置を固めつつある。Beyla や Coroot が引っ張ってきた eBPF 自動計装は『SDK なしのトレース一行』を現
2026-05-14 · 33 分で読めます #opentelemetry#observability#traces#metrics#logsOSS監視スタック2026深掘り — SigNoz・Coroot・OpenObserve・Sentry・Grafana・UptraceでDatadogを置き換える
Datadogの月額が12万ドルを超える企業がセルフホストOSSへ次々と移行している。SigNozはClickHouse上のOpenTelemetryネイティブな統合可観測性を、Corootはコード変更ゼロのeBPF APMを、OpenObserveはRustとS3でペタバイト級ログを5〜30%のコストで、Sentry self-hostedは依然エラートラッキングの標準だ。Grafanaスタック(Loki・Tempo・Mimir・Py
2026-05-14 · 28 分で読めます #observability#monitoring#signoz#coroot#openobserveObservability 完全ガイド — Metric・Log・Trace・OpenTelemetry・eBPF・SLO (Season 2 Ep 9, 2025)
「観測できなければ運用できない」。Observability はログ収集やモニタリングの上位概念で、unknown unknowns をシステム状態だけから推論する能力である。本稿では Metric・Log・Trace の3軸、Profile を加えた4軸、OpenTelemetry 標準の真価、eBPF によるカーネルレベル観測、SLO・SLI・Error Budget の実戦設計、そして Grafana Stack vs Elast
2026-04-15 · 14 分で読めます #observability#opentelemetry#prometheus#grafana#lokiObservability 2025 完全ガイド: OpenTelemetry、Grafana・Datadog・Honeycomb・SigNoz、SLO・Error Budget、LLM可観測性 (2025)
Season 5 Ep 8。可観測性なくして運用なし、運用なくしてプロダクトなし。OpenTelemetryの3大シグナル(Metric・Log・Trace)の統合、Grafanaスタック(Prometheus・Loki・Tempo・Mimir)とDatadog・New Relic・Splunkの比較、SigNoz・Honeycomb・Axiomという新世代、SLO・SLI・Error Budgetの運用、LLM可観測性(LangFus
2026-04-15 · 14 分で読めます #observability#opentelemetry#grafana#datadog#honeycomb分散トレーシング完全ガイド 2025: OpenTelemetry、Jaeger、Tempo、Span解析、サンプリング戦略
分散トレーシングの全て。Trace/Span/Context Propagation、OpenTelemetry SDK + Collector、Jaeger vs Tempo vs Zipkin、W3C Trace Context、サンプリング戦略(Head/Tail/Probabilistic)、Auto-instrumentation、コスト最適化。
2026-04-15 · 12 分で読めます #distributed-tracing#opentelemetry#jaeger#tempo#observability