更新时间:2024-11-29 GMT+08:00

ALM-24000 Flume服务不可用

告警解释

告警模块按180秒周期检测Flume服务状态,当检测到Flume服务异常时,系统产生此告警。

当系统检测到Flume服务恢复正常,且告警处理完成时,告警恢复。

告警属性

告警ID

告警级别

告警类型

业务类型

是否可自动清除

24000

紧急

处理错误告警

Flume

告警参数

类别

参数名称

参数含义

定位信息

来源

产生告警的集群名称。

服务名

产生告警的服务名称。

角色名

产生告警的角色名称。

主机名

产生告警的主机名。

对系统的影响

当Flume服务不可用时,Flume不能正常工作,数据传输业务中断。

可能原因

Flume实例全部故障。

处理步骤

  1. omm用户登录Flume实例所在节点,执行ps -ef|grep "flume.role=server"命令查看当前节点是否存在flume进程。

    • 是,执行3
    • 否,重启Flume故障实例或Flume服务,执行2

  2. 在告警列表中查看“Flume服务不可用”告警是否清除。

    • 是,处理完毕。
    • 否,执行3

收集故障信息。

  1. 在FusionInsight Manager界面,选择“运维 > 日志 > 下载”。
  2. 在“服务”框中勾选待操作集群的“Flume”。
  3. 单击右上角的时间编辑按钮,设置日志收集的“开始时间”和“结束时间”分别为告警产生时间的前后1小时,单击“下载”。
  4. 请联系运维人员,并发送已收集的故障日志信息。

告警清除

此告警修复后,系统会自动清除此告警,无需手工清除。

参考信息

不涉及。