
# ALM-12104 knox资源异常
#### 告警解释
HA每70秒周期性检测Manager的knox资源。当HA连续3次检测到knox资源异常时，产生该告警。
当HA检测到knox资源正常后，告警恢复。
#### 告警属性
| 告警ID  | 告警级别 | 是否自动清除 |
|:---|:---|:---|
| 12104 | 重要   | 是      |
   
#### 告警参数
| 参数名称 | 参数含义          |
|:---|:---|
| 来源   | 产生告警的集群或系统名称。 |
| 服务名  | 产生告警的服务名称。    |
| 角色名  | 产生告警的角色名称。    |
| 主机名  | 产生告警的主机名。     |
   
#### 对系统的影响
上层服务通过knox下发的请求无法正常处理响应。
#### 可能原因
knox进程异常。
#### 处理步骤
检查knox进程是否异常。
1. 登录FusionInsight Manager页面，在告警列表中，单击此告警所在行的，查看该告警的主机名称。
2. 使用PuTTY工具，以**root**用户登录该告警的主机地址。
3. 执行命令**su - omm** ，切换至**omm**用户。
4. 执行**sh ${BIGDATA_HOME}/om-server/om/sbin/status-oms.sh** ，查询当前HA管理的knox资源状态是否正常（normal：状态正常，其他：状态异常）。
   
   - 是，执行[步骤 7]。
   
   - 否，执行[步骤 5]。
   
   
   
   
5. 执行命令**vi $BIGDATA_LOG_HOME/omm/oms/ha/scriptlog/knox.log**，查看HA的knox资源日志，是否有关键字"ERROR"，分析日志查看资源异常原因并修复。
6. 等待5分钟，查看告警是否恢复。 
   - 是，操作结束。
   
   - 否，执行[步骤 7]。
   
   
   
   
收集故障信息。
7. 在FusionInsight Manager界面，选择"运维 \> 日志 \> 下载"。
8. 在"服务"中勾选"Controller"和"OmmServer"，单击"确定"。
9. 单击右上角的![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0000001335346816.png)设置日志收集的"开始时间"和"结束时间"分别为告警产生时间的前后1小时，单击"下载"。
10. 请联系运维人员，并发送已收集的故障日志信息。
 
