
# ALM-25008 SlapdServer CPU使用率超过阈值
#### 告警解释
系统每30秒周期性检查SlapdServer节点的CPU使用率，并把实际CPU使用率和阈值相比较，当检测到SlapdServer CPU使用率连续多次（默认值为5）超过设定阈值时，系统将产生此告警。
平滑次数可配置，当平滑次数为1，SlapdServer CPU使用率小于或等于阈值时，该告警恢复。当平滑次数大于1，SlapdServer CPU使用率小于或等于阈值的90%时，该告警恢复。
#### 告警属性
| 告警ID  | 告警级别                                                 | 是否可自动清除 |
|:---|:---|:---|
| 25008 | 紧急（默认阈值为85%） 重要（默认阈值为75%） | 是       |
   
#### 告警参数
| 参数名称              | 参数含义                  |
|:---|:---|
| 来源                | 产生告警的集群或系统名称。         |
| 服务名               | 产生告警的服务名称。            |
| 角色名               | 产生告警的角色名称。            |
| 主机名               | 产生告警的主机名。             |
| Trigger Condition | 系统当前指标取值满足自定义的告警设置条件。 |
   
#### 对系统的影响
SlapdServer实例CPU使用率过高，可能导致SlapdServer响应缓慢或不可用，引起Kerberos认证超时或操作系统用户缓存同步异常，进而导致组件业务故障。
#### 可能原因
- 告警阈值配置或者平滑次数配置不合理。
- CPU配置无法满足业务需求，CPU使用率达到上限。
 
#### 处理步骤
**检查告警阈值配置或者平滑次数配置是否合理。**
1. 登录FusionInsight Manager，选择"运维 \> 告警 \> 阈值设置 \> *待操作集群的名称* \> LdapServer \> 其他 \> SlapdServer CPU使用率"，查看告警的平滑次数和告警阈值是否设置合理。
   
   - 是，执行[步骤 4]。
   
   - 否，执行[步骤 2]。
   
   
   
   
2. 根据实际CPU使用情况修改平滑次数和告警阈值，并应用修改后的规则。
3. 等待2分钟，查看告警是否自动恢复。 
   - 是，处理完毕。
   
   - 否，执行[步骤 4]。
   
   
   
   
**检查CPU使用率是否达到上限。**
4. 在FusionInsight Manager界面，选择"运维 \> 告警 \> 告警 \> SlapdServer CPU使用率超过阈值"，查看并记录该告警的"定位信息"中上报的主机名。
5. 选择"集群 \> 服务 \> LdapServer \> 实例"，单击[步骤 4]中的主机名对应的SlapdServer实例。
6. 在实例界面观察"SlapdServer CPU使用率"图表的实时数据5分钟左右，查看CPU使用率是否多次超过设置的阈值（默认为75%）。
   
   - 是，执行[步骤 7]。
   
   - 否，执行[步骤 9]。
   
   
   
   
7. 参考[步骤 5]\~[步骤 6]请检查其他SlapdServer实例状态是否正常。
   
   - 是，请联系MRS集群管理员评估是否需要扩容SlapdServer实例，然后执行[步骤 8]。
   
   - 否，请修复故障的SlapdServer实例，然后执行[步骤 8]。
   
   
   
   
8. 检查该告警是否恢复。
   
   - 是，处理完毕。
   
   - 否，执行[步骤 9]。
   
   
   
   
**收集故障信息。**
9. 在FusionInsight Manager界面，选择"运维\>日志\>下载"。
10. 在"服务"中勾选待操作集群的"LdapServer"。
11. 单击右上角的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0000001723776449.png)设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后10分钟，单击"下载"。
12. 请联系运维人员，并发送已收集的故障日志信息。
 
#### 告警清除
此告警修复后，系统会自动清除此告警，无需手工清除。
#### 参考信息
不涉及。
