更新时间:2026-07-28 GMT+08:00
分享

集群异常

容灾主备集群switchover切换,由于异地网络异常、集群组件异常等原因导致切换异常失败,可通过该接口恢复集群为容灾主集群或者灾备集群。可使用“容灾切换异常场景集群修复”接口进行修复。

  • 集群修复接口:

    POST /v1/om/agent/mgr/cluster/dr_cluster_manual_recovery。

  • 查询阶段接口:

    对接adaptor的情况下可以使用"dorado_switchover_precheck",确认主集群降备之后,备集群检查读取主降备成功标识(Reduce standby success),为备升主提供依据。该标记没写入情况下,无法保证日志都已经完成同步,因此需要恢复原主集群;该标记已经写入的情况下,日志已经完成主备集群同步,可以恢复原备(新主)集群。

场景一:该标记位未写入,主降备流程异常会自动回滚,主集群自动恢复;回滚异常会呈现无主场景(两个灾备),使用内核修复接口进行修复,优先快速恢复原主集群对外提供服务。

场景二:该标记位已写入,说明备升主流程已经启动,备升主异常场景,针对无主场景(两个灾备集群),使用内核修复接口进行修复,快速恢复原备(新主)集群对外提供服务。

后台修复命令参考:curl -H "Content-Type:application/json" -d '{"drMode": "dorado_cluster", "drClusterMode": "primary"}' -X POST $HOST_IP:$PORT/v1/om/agent/mgr/cluster/dr_cluster_manual_recovery。
  • $HOST_IP:执行命令节点管理IP。
  • $PORT:OM_AGENT监听port。

相关文档