测验:平台的度量与运营
DORA 将四个指标分为速度和稳定性时,哪个属于稳定性?
- 部署频率和变更提前时间
- 改变故障率和服务恢复时间
- 部署频率和变更失败率
- 更改提前期和服务恢复时间
DORA指标不应该用作平台成功指标的最合适理由是什么?
- 分解部署或缩小失败的定义允许进行操纵,并且不会隔离平台的贡献。
- 因为DORA无法在Kubernetes环境中进行测量
- 因为DORA已经是一个过时的框架了。
- 因为只有四个指标,所以没有统计意义。
什么指标最直接衡量平台的核心承诺?
- 一个新团队/新服务从无到有到生产部署需要多长时间?
- 平台团队创建的模板和图表数量
- 集群节点数
- 平台团队的部署频率
使用认知负荷调查的正确方法是什么?
- 每个季度重复相同的问题以了解趋势
- 平台的成熟度是通过一次测得的绝对分数来判断的。
- 既然是定性指标,只是参考一下,不做记录。
- 通知低分团队改进措施
为什么平台团队应该在其平台上设置 SLO?
- 因为如果没有 SLO,Kubernetes 就无法调度工作负载。
- 因为 SLO 是监管要求
- 平台的可用性是所有使用它的团队的可用性,并且需要错误预算来在功能开发和稳定之间做出数值决策。
- 因为 SLO 会自动降低成本
当我需要容纳彼此不信任的租户(例如运行任意代码的外部客户)时,最不合适的隔离级别是什么?
- 簇分离
- 仅使用命名空间 + RBAC + 配额进行逻辑分离
- 按租户分隔节点池
- 云帐户和订阅分离
在 Kubernetes 环境 FinOps 中,通常认为最大成本节省点是什么?
- 资源请求超过实际使用量
- 减小容器镜像大小
- 缩短日志保留期限
- 减少命名空间的数量