LabHub
学习 学习路径 课程

可观测性

测验:告警设计

在 LabHub 中继续学习

不应该针对 CPU 使用情况设置页面通知的最准确原因是什么?

为什么“既然有很多误报,那就增加到 30 分钟”是一个反模式?

每天 400 条通知中只有 4 条产生实际行动,最大的风险是什么?

如果我将实例放在Alertmanager的group_by中会怎样?

为什么在通知路由方面“目前仅发送到 Slack 通道”的妥协是最糟糕的?

如果沉默超过30天该怎么办?