
# ALM-12018 内存使用率超过阈值
#### 告警解释
系统每30秒周期性检测内存使用率，并把实际内存使用率和阈值相比较。内存使用率默认提供一个阈值范围。当检测到内存使用率超出阈值范围时产生该告警。
平滑次数为1，主机内存使用率小于或等于阈值时，告警恢复；平滑次数大于1，主机内存使用率小于或等于阈值的90%时，告警恢复。
#### 告警属性
| 告警ID  | 告警级别                                                 | 是否自动清除 |
|:---|:---|:---|
| 12018 | 紧急（默认阈值为95%） 重要（默认阈值为90%） | 是      |
   
#### 告警参数
| 参数名称              | 参数含义                  |
|:---|:---|
| 来源                | 产生告警的集群或系统名称。         |
| 服务名               | 产生告警的服务名称。            |
| 角色名               | 产生告警的角色名称。            |
| 主机名               | 产生告警的主机名。             |
| Trigger Condition | 系统当前指标取值满足自定义的告警设置条件。 |
   
#### 对系统的影响
- 业务延迟： 主机内存使用率过高时，可能会导致业务进程运行处理缓慢、业务延迟。
- 业务失败：主机内存使用率过高时，可能会导致业务进程内存溢出，可能会导致作业运行失败。
 
#### 可能原因
内存配置无法满足业务需求。内存使用率达到上限。
#### 处理步骤
**对系统进行扩容。**
1. 进入集群FusionInsight Manager页面，在告警列表中，单击此告警所在行的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0263895749.png)，查看该告警的主机地址。
2. 以**root**用户登录告警所在主机，用户密码为安装前用户自定义，请咨询系统管理员。
3. 若内存使用率超过阈值，对集群内存进行扩容。
4. 执行以下命令，查看系统当前内存使用率。 
   ```
   free -m | grep Mem\: | awk '{printf("%s,", $3 * 100 / $2)}'
   ```
   
   
5. 等待5分钟，检查该告警是否恢复。 
   - 是，处理完毕。
   
   - 否，执行[步骤 6]。
   
   
   
   
**收集故障信息。**
6. 在主集群的FusionInsight Manager界面，选择"运维 \> 日志 \> 下载"。
7. 在"服务"中勾选"OmmServer"，单击"确定"。
8. 单击右上角的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0263895796.png)设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后10分钟，单击"下载"。
9. 请联系运维人员，并发送已收集的故障日志信息。
 
#### 告警清除
此告警修复后，系统会自动清除此告警，无需手工清除。
#### 参考信息
无。
