标签: #distributed-tracing
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 1 篇
分布式追踪真正回答的问题 — 跨度、采样,以及时间到底花在哪里
当「慢」的反馈不断进来、却不知道十个服务里谁是凶手时,你需要的就是追踪。本文从追踪、跨度与上下文传播的结构讲起,梳理出日志和指标在原理上回答不了的问题是什么。文中结合采集器配置,讲清自动埋点覆盖到哪里、哪些位置必须补上手动跨度、头部采样为什么会优先丢掉你最需要的追踪,以及尾部采样如何解决这一点、代价又是什么。接着讲跨消息队列传播上下文时为什么要用链接而不是父子关系,最后给出在真实追踪界面上到底该找什么的排查顺序。
2026-07-26 · 21 分钟阅读 #observability#distributed-tracing#opentelemetry#tail-sampling#performance