
# ALM-12091 disaster资源异常
#### 告警解释
HA每86秒周期性检测Manager的disaster资源。当HA连续10次检测到disaster资源异常时，产生该告警。
当HA检测到disaster资源正常后，告警恢复。
disaster资源为单主资源，一般资源异常会导致主备倒换，看到告警时，基本已经主备倒换，并在新主环境上启动新的disaster资源，告警恢复。该告警用于提示用户，Manager主备倒换的原因。
#### 告警属性
| 告警ID  | 告警级别 | 是否可自动清除 |
|:---|:---|:---|
| 12091 | 重要   | 是       |
   
#### 告警参数
| 参数名称 | 参数含义          |
|:---|:---|
| 来源   | 产生告警的集群或系统名称。 |
| 服务名  | 产生告警的服务名称。    |
| 角色名  | 产生告警的角色名称。    |
| 主机名  | 产生告警的主机名。     |
   
#### 对系统的影响
- 触发Manager主备倒换。
- 如果倒换后disaster进程仍旧异常会不断主备倒换，可能引起主备容灾功能不可用或Manager界面无法访问。
 
#### 可能原因
disaster进程异常。
#### 处理步骤
**检查disaster进程是否异常。**
1. 打开FusionInsight Manager页面，在告警列表中，单击此告警所在行的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0000001723520081.png)，查看该告警的主机名称。
2. 以**root**用户登录该告警的主机地址，用户密码为安装前用户自定义，请咨询系统管理员。
3. 执行命令**su - omm** ，切换至**omm**用户。
4. 执行**sh ${BIGDATA_HOME}/om-server/OMS/workspace0/ha/module/hacom/script/status_ha.sh** ，查询当前HA管理的disaster资源状态是否正常（单机模式下面，disaster资源为normal状态；双机模式下，disaster资源在主节点为normal状态，在备节点为stopped状态。）
   
   - 是，执行[步骤 7]。
   
   - 否，执行[步骤 5]。
   
   
   
   
5. 执行命令**vi ${BIGDATA_LOG_HOME}/disaster/disaster.log**，查看ha的disaster资源日志，是否有关键字"ERROR"，分析日志查看资源异常原因并修复。
6. 等待5分钟，查看告警是否恢复。 
   - 是，操作结束。
   
   - 否，执行[步骤 7]。
   
   
   
   
**收集故障信息。**
7. 在FusionInsight Manager界面，选择"运维 \> 日志 \> 下载"。
8. 在"服务"中勾选"Disaster"，单击"确定"。
9. 单击右上角的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0000001675480954.png)设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后1小时，单击"下载"。
10. 请联系运维人员，并发送已收集的故障日志信息。
 
#### 告警清除
此告警修复后，系统会自动清除此告警，无需手工清除。
#### 参考信息
不涉及。
