
# ALM-26053 Storm Slot使用率超过阈值（2.x及以前版本）
#### 告警解释
系统每60秒周期性检测Slot使用率，并把实际Slot使用率和阈值相比较。当检测到Slot使用率高于阈值时产生该告警。
用户可通过"系统设置 \> 阈值配置"修改阈值。
当Slot使用率小于或等于阈值时，告警恢复。
#### 告警属性
| **告警ID** | **告警级别** | **可自动清除** |
|:---|:---|:---|
| 26053    | 严重       | 是         |
   
#### 告警参数
| **参数名称**          | **参数含义**              |
|:---|:---|
| ServiceName       | 产生告警的服务名称。            |
| RoleName          | 产生告警的角色名称。            |
| HostName          | 产生告警的主机名。             |
| Trigger condition | 系统当前指标取值满足自定义的告警设置条件。 |
   
#### 对系统的影响
用户无法执行新的Storm任务。
#### 可能原因
- 集群中Supervisor处于异常状态。
- 集群中Supervisor的状态正常，但是处理能力不足。
 
#### 处理步骤
1. 检查Supervisor状态。 
   1. 登录MRS集群详情页面，选择"组件管理"。
   
   2. 选择"Storm \> Supervisor"，进入Storm服务管理页面。
   
   3. 查看"角色"中是否存在状态为故障或者是正在恢复的Supervisor实例。
      - 是，执行[1.d]。
      
      - 否，执行[2.a]或者[3.a]。
       
   
   4. 勾选状态为"故障"或者"正在恢复"的Supervisor角色实例，选择"更多 \> 重启实例"，查看是否重启成功。
      - 是，执行[1.e]。
      
      - 否，执行[步骤 4]。
       
   
   5. 等待一段时间，检查该告警是否恢复。
      - 是，处理完毕。
      
      - 否，执行[2.a]或者[3.a]。
       
   
   
   
   
2. 增加Supervisor Slot数量配置。 
   1. 登录MRS集群详情页面，选择"组件管理"。
   
   2. 选择"Storm \> Supervisor \> 服务配置 \> 全部配置"。
   
   3. 调整"supervisor.slots.ports"的数值，适当增加每个Supervisor上Slot的数量，并重启实例。
   
   4. 等待一段时间，检查该告警是否恢复。
      - 是，处理完毕。
      
      - 否，执行[步骤 4]。
       
   
   
   
   
3. 对Supervisor进行扩容。 
   1. 添加节点。
   
   2. 等待一段时间，检查该告警是否恢复。
      - 是，处理完毕。
      
      - 否，执行[步骤 4]。
       
   
   
   
   
4. 收集故障信息。
   
   1. 在MRS Manager界面，单击"系统设置 \> 日志导出"。
   
   2. 请联系运维人员，并发送已收集的故障日志信息。
   
   
   
   
 
#### 参考信息
无。
