更新时间:2026-07-28 GMT+08:00
常见问题
- Q1:重建任务启动失败,报错“could not connect to server: Connection timed out”。
- 问题现象:执行gs_ctl build命令后,长时间等待后返回连接超时错误。
- 原因分析:
- 主备节点之间的网络不通。
- 主节点的监听地址(listen_addresses)未配置为备节点可访问的IP或*。
- 防火墙或安全组规则阻止了数据库端口或流复制端口的通信。
- 处理方法:
- 使用ping和telnet <primary_ip> <port>命令检查网络连通性。
- 检查主节点gaussdb.conf中的listen_addresses配置。
- 检查并放通防火墙规则。
- Q2:重建过程中,主节点性能急剧下降,业务受到影响。
- 问题现象:重建开始后,主数据库的查询和事务响应时间变长。
- 原因分析:全量数据读取和发送占用了大量磁盘I/O和网络I/O资源。
- 处理方法:
- 紧急处理:暂停重建任务(可通过kill进程实现,需谨慎操作)。
- 规划规避:在业务低峰期重新执行重建任务。
- 长期优化:考虑升级网络带宽,或使用更高性能的存储介质。
- Q3:重建进度缓慢,远低于预期速度。
- 问题现象:重建持续了非常长的时间,监控显示网络或磁盘利用率不高。
- 原因分析:
- 网络带宽本身不足或存在波动。
- 主节点或备节点的磁盘I/O存在瓶颈(如慢磁盘、RAID降级)。
- 主节点业务负载极高,CPU资源争用严重,影响了Data Sender进程的调度。
- 处理方法:
- 使用iostat -x 1和nethogs等工具定位是网络还是磁盘的瓶颈。
- 检查存储系统状态(如RAID卡状态、SSD寿命)。
- 在业务低峰期进行重建。
父主题: 主备重建