切换出现异常情况下的修复
处理依据:切换流程执行结束后,查看两个集群后置检查接口的返回结果,详细操作请参见容灾演练后置检查。
- 情况一:
后置检查接口的返回hadr_cluster_stat:两个集群的容灾状态无archive,该情况说明切换后无主集群。
修复方案:
对原主集群调用“容灾切换异常场景集群修复”接口POST /v1/om/agent/mgr/cluster/dr_cluster_manual_recovery,快速恢复原主集群对外提供服务。
基于集群管理模式的容灾关系时,修复完成后可通过集群刷新容灾序列接口POST /v1/om/agent/mgr/cluster/dr_cluster_serial_change指定“opt_type”为“set_dr_repl_dest_conf”修改集群日志接收端信息。
- 情况二:
后置检查接口的返回hadr_cluster_stat:两个集群的容灾状态无recovery,该情况说明切换后无灾备集群。
修复方案:
对原主集群调用“容灾切换异常场景集群修复”接口POST /v1/om/agent/mgr/cluster/dr_cluster_manual_recovery,修复为灾备集群。
基于集群管理模式的容灾关系时,修复完成后可通过集群刷新容灾序列接口POST /v1/om/agent/mgr/cluster/dr_cluster_serial_change指定“opt_type”为“set_dr_repl_dest_conf”修改集群日志接收端信息。
- 情况三:
后置检查接口的返回hadr_cluster_stat:原主集群状态为archive,原灾备集群状态为recovery,该情况说明切换流程异常,并且主备集群都发生回滚,容灾关系未改变。
修改方案:
依据后置检查接口的返回的以下值是否为空,针对异常组件进行修复。
- not_in_switchover_instance_ids:未参与主备倒换的组件实例ID。
- incorrect_params_instance_ids:参数配置错误的组件实例ID(若其中存在['dr_dest_name', 'Incorrect'],请使用情况五对dr_dest_name进行修复)。
- 情况四:
后置检查接口的返回hadr_cluster_stat:原主集群已经降备为recovery,原灾备集群升主为archive。该情况说明切换流程异常,并且主备集群未发生回滚,容灾关系已改变,切换实际已经完成。
依据后置检查接口的返回的以下值是否为空,针对异常组件进行修复。
- not_in_switchover_instance_ids:未参与主备倒换的组件实例ID。
- incorrect_params_instance_ids:参数配置错误的组件实例ID(若其中存在['dr_dest_name', 'Incorrect'],请使用情况五对dr_dest_name进行修复)。
- 情况五:
后置检查接口返回的incorrect_params_instance_ids中存在['dr_dest_name', 'Incorrect']时,通过集群刷新容灾序列接口POST /v1/om/agent/mgr/cluster/dr_cluster_serial_change指定“opt_type”为“set_dr_repl_dest_conf”修改集群日志接收端信息。