GeminiDB Redis事件监控支持的事件说明
功能说明
事件监控提供了事件类型数据上报、查询和告警的功能。方便您将业务中的各类重要事件或对云资源的操作事件收集到云监控服务,并在事件发生时进行告警。
云监控服务最大支持4个层级维度,维度编号从0开始,编号3为最深层级。例如事件列表中的维度信息为“redis_cluster_id,redis_node_id”时,表示对应的监控事件的维度存在层级关系,且“redis_cluster_id”为0层,“redis_node_id”为1层。
命名空间
SYS.NoSQL
事件监控支持的事件列表
| 事件名称 | 事件ID | 事件级别 | 事件说明 | 处理建议 | 事件影响 | 维度 |
|---|---|---|---|---|---|---|
| 节点高可用倒换 | NodeHaSwitch | 重要 | 由于shard重启触发主从倒换时,会上报该事件,属于重要告警事件。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 |
| redis_cluster_id |
| 实例运行状态异常 | NoSQLFaultyDBInstance | 重要 | 由于灾难或者物理机故障导致实例故障时,会上报该事件,属于关键告警事件。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 可能导致数据库服务不可用。 | redis_cluster_id |
| 实例运行状态异常已恢复 | NoSQLDBInstanceRecovered | 重要 | 针对灾难性的故障,NoSQL有高可用工具会自动进行恢复或者手动恢复,执行完成后会上报该事件。 | 不需要处理。 | 无 | redis_cluster_id |
| 节点运行状态异常 | NoSQLFaultyDBNode | 重要 | 由于灾难或者物理机故障导致数据库节点故障时,会上报该事件,属于关键告警事件。 | 检查数据库服务是否可以正常使用,并在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 可能导致数据库服务不可用。 | redis_cluster_id,redis_node_id |
| 节点运行状态异常已恢复 | NoSQLDBNodeRecovered | 重要 | 针对灾难性的故障,NoSQL有高可用工具会自动进行恢复或者手动恢复,执行完成后会上报该事件。 | 不需要处理。 | 无 | redis_cluster_id,redis_node_id |
| 创建实例业务失败 | NoSQLCreateInstanceFailed | 重要 | 一般是由于实例配额不足或底层资源不足等原因导致。 | 先释放不再使用的实例再尝试重新发放,或者您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单调整配额上限。 | 无法创建数据库实例。 | redis_cluster_id |
| 变更规格失败 | NoSQLResizeInstanceFailed | 重要 | 一般是由于底层资源不足等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维在后台协调资源再重试规格变更操作。 | 业务中断。 | redis_cluster_id |
| 添加节点失败 | NoSQLAddNodesFailed | 重要 | 一般是由于底层资源不足等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,交工单让运维在后台协调资源,删除添加失败的节点,重新尝试添加新节点。 | 无 | redis_cluster_id |
| 删除节点失败 | NoSQLDeleteNodesFailed | 重要 | 一般是由于底层释放资源失败导致。 | 重新尝试删除节点。 | 无 | redis_cluster_id |
| 扩卷失败 | NoSQLScaleUpStorageFailed | 重要 | 一般是由于底层资源不足等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维在后台协调资源再重试扩卷操作。 | 如果磁盘满,会导致业务中断。 | redis_cluster_id |
| 重置密码失败 | NoSQLResetPasswordFailed | 重要 | 一般是由于重置密码命令超时导致。 | 重新尝试重置密码操作。 | 无 | redis_cluster_id |
| 修改参数模板失败 | NoSQLUpdateInstanceParamGroupFailed | 重要 | 一般是由于修改参数模板命令超时导致。 | 重新尝试修改参数模板操作。 | 无 | redis_cluster_id |
| 设置备份策略失败 | NoSQLSetBackupPolicyFailed | 重要 | 一般是由于数据库连接异常导致。 | 重新重试设置备份策略操作。 | 无 | redis_cluster_id |
| 创建手动备份失败 | NoSQLCreateManualBackupFailed | 重要 | 一般是备份文件导出失败或上传失败等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 无法备份数据。 | redis_cluster_id |
| 创建自动备份失败 | NoSQLCreateAutomatedBackupFailed | 重要 | 一般是备份文件导出失败或上传失败等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 无法备份数据。 | redis_cluster_id |
| 数据盘空间不足 | NoSQLRiskyDataDiskUsage | 重要 | 数据盘空间不足,产生此告警。 | 请参见扩容和缩容磁盘进行磁盘扩容。 | 实例被设为只读模式,数据无法写入。 | redis_cluster_id |
| 数据盘空间已扩容并恢复可写 | NoSQLDataDiskUsageRecovered | 重要 | 数据盘空间已扩容并恢复可写,产生此事件。 | 无需处理。 | 无 | redis_cluster_id |
| 重启数据库失败 | NoSQLRestartDBFailed | 重要 | 一般是由于实例状态异常等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 数据库实例状态可能存在异常。 | redis_cluster_id |
| 恢复到新实例失败 | NoSQLRestoreToNewInstanceFailed | 重要 | 一般是由于底层资源不足等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维在后台协调资源,重新尝试添加新节点。 | 无法恢复到新的数据库实例。 | redis_cluster_id |
| 恢复到已有实例失败 | NoSQLRestoreToExistInstanceFailed | 重要 | 一般是由于备份文件下载或恢复失败等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 当前数据库实例可能处于不可用状态。 | redis_cluster_id |
| 删除备份文件失败 | NoSQLDeleteBackupFailed | 重要 | 一般是由于备份文件从obs删除失败导致。 | 重新尝试删除备份文件。 | 无 | redis_cluster_id |
| 切换慢日志明文开关失败 | NoSQLSwitchSlowlogPlainTextFailed | 重要 | 一般是由于接口不支持切换等原因导致。 | 请查阅GeminiDB用户指南,确认接口支持打开慢日志明文开关。您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 无 | redis_cluster_id |
| 绑定EIP失败 | NoSQLBindEipFailed | 重要 | 一般是由于节点状态不正常,节点已经绑定EIP或EIP非法等原因导致。 | 检查节点是否正常,EIP是否合法。 | 无法通过公网访问数据库实例。 | redis_cluster_id |
| 解绑EIP失败 | NoSQLUnbindEipFailed | 重要 | 一般是由于节点状态不正常,节点未绑定EIP等原因导致。 | 检查节点和EIP状态是否正常。 | 无 | redis_cluster_id |
| 修改参数失败 | NoSQLModifyParameterFailed | 重要 | 一般是由于参数取值非法等原因导致。 | 排查参数值是否在合法范围内,您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 无 | redis_cluster_id |
| 参数模板应用失败 | NoSQLApplyParameterGroupFailed | 重要 | 一般是由于实例状态异常导致参数模板无法应用等原因导致。 | 您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单让运维处理。 | 无 | redis_cluster_id |
| 开启或关闭SSL失败 | NoSQLSwitchSSLFailed | 重要 | 一般是由于修改SSL命令超时导致。 | 重新提交一次或者您可以在管理控制台右上角,选择“工单 > 新建工单”,提交工单处理,并先保持切换之前使用SSL的连接方式。 | 是否使用SSL连接。 | redis_cluster_id |
| 用户计划删除KMS密钥 | planDeleteKmsKey | 重要 | 由于用户计划删除KMS密钥导致。 | 及时检查此密钥关联的GeminiDB实例是否已删除或不再使用,密钥删除后将影响实例业务的正常运行。 | 密钥到期后会自动删除,删除后将影响实例业务的正常运行。 | redis_cluster_id |
维度
| Key | Value |
|---|---|
| redis_cluster_id | GeminiDB Redis数据库实例的集群ID。 该取值可通过云监控服务的“查询主机监控维度指标信息”获取。 |
| redis_node_id | GeminiDB Redis数据库实例的节点ID。 该取值可通过云监控服务的“查询主机监控维度指标信息”获取。 |