更新时间:2026-07-28 GMT+08:00
分享

常见问题

  • Q1:重建任务启动失败,报错“could not connect to server: Connection timed out”。
    • 问题现象:执行gs_ctl build命令后,长时间等待后返回连接超时错误。
    • 原因分析
      1. 主备节点之间的网络不通。
      2. 主节点的监听地址(listen_addresses)未配置为备节点可访问的IP或*。
      3. 防火墙或安全组规则阻止了数据库端口或流复制端口的通信。
    • 处理方法
      1. 使用ping和telnet <primary_ip> <port>命令检查网络连通性。
      2. 检查主节点gaussdb.conf中的listen_addresses配置。
      3. 检查并放通防火墙规则。
  • Q2:重建过程中,主节点性能急剧下降,业务受到影响。
    • 问题现象:重建开始后,主数据库的查询和事务响应时间变长。
    • 原因分析:全量数据读取和发送占用了大量磁盘I/O和网络I/O资源。
    • 处理方法
      1. 紧急处理:暂停重建任务(可通过kill进程实现,需谨慎操作)。
      2. 规划规避:在业务低峰期重新执行重建任务。
      3. 长期优化:考虑升级网络带宽,或使用更高性能的存储介质。
  • Q3:重建进度缓慢,远低于预期速度。
    • 问题现象:重建持续了非常长的时间,监控显示网络或磁盘利用率不高。
    • 原因分析
      1. 网络带宽本身不足或存在波动。
      2. 主节点或备节点的磁盘I/O存在瓶颈(如慢磁盘、RAID降级)。
      3. 主节点业务负载极高,CPU资源争用严重,影响了Data Sender进程的调度。
    • 处理方法
      1. 使用iostat -x 1和nethogs等工具定位是网络还是磁盘的瓶颈。
      2. 检查存储系统状态(如RAID卡状态、SSD寿命)。
      3. 在业务低峰期进行重建。

相关文档