测验:负载与 CPU
8核服务器的平均负载为24,但CPU空闲率为60%。首先要检查什么?
- 监控代理测量不正确的错误
- D 状态(不间断等待)进程数和存储指标
- CPU温度和工作时钟恶化
- 总内存使用量和交换空间
从负载平均值是指数衰减平均值而不是算术平均值这一事实可以得出什么实际结论?
- 故障结束后的15分钟平均值较高是正常的,因此不应根据该值设置警报。
- 短尖峰看起来比实际大得多
- 1分钟平均值最不准确
- 该值不能超过核心数
在 CPU 限制为 1 个核心的容器中,具有 8 个线程的应用程序速度很慢。使用率似乎为12%。去哪里检查?
- /proc/loadavg 显示负载平均值三个值
- cgroup cpu.stat 中的 nr_throttled 和 nr_periods
- 顶部显示的窃取时间值
- /proc/meminfo 中的可用内存
Top 的抢断时间始终保持在 15%。正确的反应是什么?
- 将访客重新定位到另一台物理主机(停止/启动云 API)
- 优化来宾内部运行的应用程序代码
- 在来宾中重新启动
- vCPU 数量加倍
PSI(/proc/Pressure) 向平均负载添加哪些信息?
- 停止了多长时间(时间百分比)
- 是什么过程导致的?
- CPU 核心利用率
- 是否存在内存泄漏?
nproc显示16,如果负载为16,是否可以认为饱和?
- 这是正确的。 nproc准确代表处理能力
- 不。负载总是在核心数量一半时饱和
- 这是正确的。唯一的例外是容器。
- 不。如果是SMT,可以有8个物理核心,D态污染也依然存在。