文档首页/ 数据复制服务 DRS/ 实时同步/ 入云/ 将Redis集群同步到GeminiDB Redis
更新时间:2024-11-29 GMT+08:00

将Redis集群同步到GeminiDB Redis

支持的源和目标数据库

表1 支持的数据库

源数据库

目标数据库

  • 本地自建官方Redis开源集群(3.0.x、4.0.x、5.0.x版本)
  • ECS自建官方Redis开源集群(3.0.x、4.0.x、5.0.x版本)
GeminiDB Redis
说明:

仅支持目标库版本等于或高于源库版本。

目前仅支持白名单用户使用。

支持的同步对象范围

在使用DRS进行同步时,不同类型的同步任务,支持的同步对象范围不同,详细情况可参考表2DRS会根据用户选择,在“预检查”阶段对同步对象进行自动检查

表2 支持的同步对象

类型名称

使用须知

同步对象范围

  • 同步对象选择维度:全部同步。
  • 支持的同步对象
    • 支持String,Hash,List,Set,Sorted Set类型迁移。
    • 支持Lua脚本迁移。
    • 不支持事务的迁移。
    • 不支持Stream,BitMap,HyperLogLog,GEO类型迁移。
    • 不支持自定义类型。
    • 不支持迁移目标库GeminiDB Redis不支持的命令。

使用建议

如果您使用的是全量同步模式,确保源和目标数据库无业务写入,保证同步前后数据一致。如果您使用的是全量+增量同步模式,支持在源数据库有业务数据写入的情况下进行同步。

  • 数据库同步与环境多样性和人为操作均有密切关系,为了确保同步的平顺,建议您在进行正式的数据库同步之前进行一次演练,可以帮助您提前发现问题并解决问题。
  • 同步阶段,确保目标数据库无业务写入,保证同步前后数据一致。
  • 基于以下原因,建议您在启动任务时选择“稍后启动”功能,将启动时间设置在业务低峰期,相对静止的数据可以有效提升一次性同步成功率,避免同步对业务造成性能影响。
    • 在网络无瓶颈的情况下,全量同步会对源数据库增加约20MB/s的查询压力,以及占用2~4个CPU。

使用须知

DRS全量+增量同步过程一般包含四个阶段:任务启动阶段、全量阶段、增量阶段、结束任务阶段(单全量任务则包含三个阶段)。为了确保同步各个阶段的平顺,在创建同步任务前,请务必阅读以下使用须知。

表3 使用须知

类型名称

使用和操作限制

任务启动前须知

  • 源数据库对象要求:
    • 创建全量+增量任务,需要支持PSYNC命令。
  • 目标数据库对象要求:
    • 目标库必须是本云GeminiDB Redis实例。
    • 同步前目标库GeminiDB Redis实例建议为空。
    • 目标数据库实例版本要高于或等于源数据库版本。
  • 其他使用须知:
    • 全量+增量任务使用解析RDB的方式读取数据。
    • 迁移Lua脚本时,源库需要同时有其它数据,否则无法解析出RDB中的Lua脚本,导致Lua脚本同步失败。
    • DRS不会对目标库进行FLUSH等高危操作,所以对于List列表类型数据,可能出现重复的数据。
    • 源库测试连接时,必须填写Redis集群所有分片的IP地址。同时为了避免影响源端Redis实例的业务访问,强烈建议从源实例的副本节点(从节点)进行数据同步,即推荐填写Redis集群的Slave节点IP地址。
    • 为保障增量同步有效进行,建议同步前,评估源库Redis参数,将源库的配置文件redis.conf中repl-backlog-size参数的值适当调大。
    • 同步过程中,如果源库Redis集群发生扩缩容(例如增加或者减少分片)、规格变配(例如扩大内存),则需要重新配置同步任务。且为保证数据一致性,在重新配置任务前,建议先清空已迁移至目标GeminiDB Redis的数据。
    • 如果源库中的某些Key设置了过期(expire)策略,由于可能存在Key已过期但未被及时删除的情况,所以在目标库中查看Key数量(例如通过info命令查看)时会比源库的Key数量少。为保障数据的一致性,建议设置延长Key的过期时间。

全量迁移阶段须知

  • 同步过程中,不允许修改连接源和目标数据库的密码,或修改源和目标数据库的端口号。
  • 同步过程中,如果源库Redis集群发生主备倒换,任务会失败,需要清空目标库重置任务。
  • 同步过程中,不允许对正在迁移中的目标数据库进行修改操作。

增量迁移阶段须知

  • 同步过程中,不允许修改连接源和目标数据库的密码,或修改源和目标数据库的端口号。
  • 同步过程中,如果源库Redis集群发生主备倒换,任务会失败,需要清空目标库重置任务。
  • 同步过程中,不允许对正在同步中的目标数据库进行修改操作。

前提条件

操作步骤

本章节将介绍在公网网络场景下,通过数据复制服务配置Redis集群数据库同步至GeminiDB Redis的任务流程。

  1. 在“实时同步管理”页面,单击“创建同步任务”。
  2. 在“同步实例”页面,填选区域、项目、任务名称、描述、同步实例信息,单击“开始创建”

    • 任务信息
      图1 同步任务信息
      表4 任务和描述

      参数

      描述

      区域

      当前所在区域,可进行切换。

      项目

      当前区域对应的项目,可进行切换。

      任务名称

      任务名称在4到50位之间,必须以字母开头,可以包含字母、数字、中划线或下划线,不能包含其他的特殊字符。

      描述

      描述不能超过256位,且不能包含! = < > & ' " \ 特殊字符。

    • 同步实例信息
      图2 同步实例信息

      表5 同步实例信息

      参数

      描述

      数据流动方向

      选择入云。

      入云指目标端数据库为本云数据库。

      源数据库引擎

      选择“Redis集群”

      目标数据库引擎

      选择“GeminiDB Redis”。

      网络类型

      此处以“公网网络”为示例。可根据业务场景选择“公网网络”“VPC网络”“VPN、专线网络”

      • VPC网络:适合云上同账号同Region同VPC场景下数据库之间的同步。
      • 公网网络:适合通过公网网络把其他云下或其他平台的数据库同步到目标数据库,该类型要求数据库绑定弹性公网IP(EIP)。
      • VPN、专线网络:适合VPN、专线、CC、VPCEP、或者用户已打通VPC对等连接的网络场景,实现其他云下自建数据库与云上数据库同步、云上同Region跨账号、或云上跨Region的数据库之间的同步。

      目标数据库实例

      用户所创建的目标数据库实例。

      同步实例所在子网

      请选择同步实例所在的子网。也可以单击“查看子网”,跳转至“网络控制台”查看实例所在子网帮助选择。

      默认值为当前所选数据库实例所在子网,请选择有可用IP地址的子网。为确保同步实例创建成功,仅显示已经开启DHCP的子网。

      同步模式

      • 全量+增量:该模式为数据库持续性同步,适用于对业务中断敏感的场景,通过全量同步过程完成目标端数据库的初始化后,增量同步阶段通过解析日志等技术,将源端和目标端数据库保持数据持续一致。
        说明:

        选择“全量+增量”同步模式,增量同步可以在全量同步完成的基础上实现数据的持续同步,无需中断业务,实现同步过程中源业务和数据库继续对外提供访问。

      源端分片个数

      连接源端Redis集群的子任务个数,输入值在1到16之间,且输入值不能大于源端Redis集群的分片个数,请根据源端Redis集群的规模合理选择。建议集群的每4个分片设置1个源端分片个数,即每1个子任务连接源端集群的4个分片。

      指定公网IP

      网络类型选择“公网网络”时可见,选择为DRS实例绑定的弹性公网IP。任务创建时,DRS将会自动绑定该弹性公网IP,等待任务结束后将自动解绑该弹性公网IP。指定公网IP数量需要与实例数量匹配。

      公网网络迁移产生的数据传输费用收取标准请参见:弹性公网IP价格计算器

    • 可用区
      图3 可用区
      表6 任务可用区

      参数

      描述

      可用区

      DRS任务创建的可用区,选择跟源或目标库相同的可用区性能更优。

    • 企业项目和标签
      图4 企业项目和标签

      表7 企业项目和标签

      参数

      描述

      企业项目

      企业项目是一种云资源管理方式,企业项目管理服务提供统一的云资源按项目管理,以及项目内的资源管理、成员管理。请在下拉框中选择所在的企业项目,其中,default为默认项目。

      更多关于企业项目的信息,请参见《企业管理用户指南》

      如果需要自定义企业项目,请在控制台右上角单击“企业”,进入“企业项目管理”页面创建,具体请参见《企业管理用户指南》中“创建企业项目”的内容。

      标签

      • 可选配置,对同步任务的标识。使用标签可方便管理您的任务。每个任务最多支持20个标签配额。
      • 如果您的组织已经设定DRS的相关标签策略,则需按照标签策略规则为任务添加标签。标签如果不符合标签策略的规则,则可能会导致任务创建失败,请联系组织管理员了解标签策略详情。
      • 任务创建成功后,您可以单击任务名称,在“标签”页签下查看对应标签。关于标签的详细操作,请参见标签管理

    对于创建失败的任务,DRS默认保留3天,超过3天将会自动结束任务。

  3. 在“源库及目标库”页面,同步实例创建成功后,填选自建DNS服务配置、源库信息和目标库信息,单击“源库和目标库”处的“测试连接”,分别测试并确定与源库和目标库连通后,勾选协议,单击“下一步”

    • 自建DNS服务配置(选填)
      图5 自建DNS服务器
      表8 自建DNS信息

      参数

      描述

      是否配置自建DNS服务器

      当用户需要填写自建的内网域名数据库地址作为源或者目标库时,请开启此选项。

      自建DNS服务IP

      填写用户自建的DNS服务IP信息。

      配置自建DNS服务IP后,用户可在源库或目标库的“IP地址或域名”处填写您自建的内网域名数据库地址进行数据迁移。

      当用户需要填写自建的内网域名数据库地址作为源或者目标库时,此功能能够实现。

      自建DNS功能目前仅支持白名单用户,需要提交工单申请才能使用。您可以在管理控制台右上角,选择“工单 > 新建工单”,完成工单提交。

    • 源库信息
      图6 源库信息页面
      表9 源库信息

      参数

      描述

      IP地址或域名

      源数据库的IP地址或域名,格式为IP地址/域名:端口。

      请填写源端Redis集群所有分片的IP地址和对应端口,并且推荐填写集群分片的Slave节点的IP地址。最多支持填写32个IP地址或域名,多个值之间请用英文逗号隔开。例如192.168.0.1:8080,192.168.0.2:8080。

      数据库密码

      源数据库的密码。

      源数据库的IP地址或域名和密码,会被系统加密暂存,直至删除该同步任务后自动清除。

    • 目标库信息配置
      图7 目标库信息
      表10 目标库信息

      参数

      描述

      数据库实例名称

      默认为创建同步任务时选择的数据库实例,不可进行修改。

      数据库密码

      目标数据库的登录密码。

      目标数据库的密码将在迁移过程中被加密暂存到数据库和同步实例主机上,待该任务删除后会永久清除。

  4. “同步设置”页面,设置同步对象,单击“下一步”

    图8 设置同步对象

    表11 同步对象

    参数

    描述

    同步对象

    目前仅支持全部同步。

  5. “预检查”页面,进行同步任务预校验,校验是否可进行同步。

    • 查看检查结果,如有不通过的检查项,需要修复不通过项后,单击“重新校验”按钮重新进行同步任务预校验。

      预检查不通过项处理建议请参见《数据复制服务用户指南》中的“预检查不通过项修复方法”。

    • 预检查完成后,且预检查通过率为100%时,单击“下一步”。

      所有检查项结果均通过时,若存在请确认项,需要阅读并确认详情后才可以继续执行下一步操作。

  6. “任务确认”页面,设置同步任务的启动时间、任务异常通知设置、SMN主题、时延阈值、任务异常自动结束时间,并确认同步任务信息无误后,单击“启动任务”,提交同步任务。

    图9 任务启动设置

    表12 任务启动设置

    参数

    描述

    启动时间

    同步任务的启动时间可以根据业务需求,设置为“立即启动”或“稍后启动”,优选“稍后启动”。

    说明:

    预计同步任务启动后,会对源数据库和目标数据库的性能产生影响,建议您将任务启动时间设定在业务低峰期,同时预留2-3天校对数据。

    任务异常通知设置

    该项为可选参数,开启之后,选择对应的SMN主题。当入云同步任务即将开始计费或者同步任务状态、时延指标、数据等异常时,系统将发送通知。

    SMN主题

    “任务异常通知设置”项开启后可见,需提前在SMN上申请主题并添加订阅。

    SMN主题申请和订阅可参考《消息通知服务用户指南》

    时延阈值

    在增量同步阶段,源数据库和目标数据库之间的同步有时会存在一个时间差,称为时延,单位为秒。

    时延阈值设置是指时延超过一定的值后(时延阈值范围为0到3600s),DRS可以发送告警通知。告警通知将在时延稳定超过设定的阈值6min后发送,避免出现由于时延波动反复发送告警通知的情况。

    说明:
    • 首次进入增量同步阶段,会有较多数据等待同步,存在较大的时延,属于正常情况,不在此功能的监控范围之内。
    • 设置时延阈值之前,需要设置任务异常通知。
    • 当时延阈值设置为0时,不会发送通知给收件人。

    数据异常通知

    该项为可选参数,开启之后,当同步任务数据异常时,系统将发送通知。

    任务异常自动结束时间(天)

    设置任务异常自动结束天数,输入值必须在14到100之间,默认值14。

    说明:

    异常状态下的任务仍然会计费,而长时间异常的任务无法续传和恢复。设置任务异常自动结束天数后,异常且超时的任务将会自动结束,以免产生不必要的费用。

  7. 同步任务提交后,您可在“实时同步管理”页面,查看并管理自己的任务

    • 您可查看任务提交后的状态,状态请参见任务状态说明
    • 在任务列表的右上角,单击刷新列表,可查看到最新的任务状态。
    • 对于未启动、状态为配置中的任务,DRS默认保留3天,超过3天DRS会自动删除后台资源,当前任务状态不变。当用户再次配置时,DRS会重新申请资源,此时DRS任务IP会发生改变。
    • 对于公网网络类型的任务,由于DRS需要在任务结束后删除后台资源,所以该任务绑定的弹性公网IP需要等待一段时间,才能恢复为解绑状态。