文档首页/ 数据复制服务 DRS/ 实时同步/ 出云/ 将GeminiDB Redis同步到Redis集群
更新时间:2024-11-29 GMT+08:00

将GeminiDB Redis同步到Redis集群

支持的源和目标数据库

表1 支持的数据库

源数据库

目标数据库

GeminiDB Redis

  • ECS自建Redis集群(开源Redis 4.0版本以上)
  • 本地自建Redis集群(开源Redis 4.0版本以上)

目前仅支持白名单用户使用。

支持的同步对象范围

在使用DRS进行同步时,不同类型的同步任务,支持的同步对象范围不同,详细情况可参考表2DRS会根据用户选择,在“预检查”阶段对同步对象进行自动检查

表2 支持的同步对象

类型名称

使用须知

同步对象范围

  • 同步对象选择维度:仅支持全部同步
  • 支持的同步对象
    • 支持String,Hash,List,Set,Sorted Set类型同步
    • 不支持Lua脚本和事务的同步
    • 不支持Stream,Exhash ,Bloomfilter类型同步
    • 不支持自定义类型。
    • 不支持同步目标库不支持的命令。
    • 不支持同步没有hash_tag的批量操作命令。

使用建议

如果您使用的是全量同步模式,确保源和目标数据库无业务写入,保证同步前后数据一致。如果您使用的是全量+增量同步模式,支持在源数据库有业务数据写入的情况下进行迁移。

  • 数据库同步与环境多样性和人为操作均有密切关系,为了确保同步的平顺,建议您在进行正式的数据库迁移之前进行一次演练,可以帮助您提前发现问题并解决问题。
  • 同步阶段,确保目标数据库无业务写入,保证同步前后数据一致。
  • 基于以下原因,建议您在启动任务时选择“稍后启动”功能,将启动时间设置在业务低峰期,相对静止的数据可以有效提升一次性同步成功率,避免同步对业务造成性能影响。
    • 在网络无瓶颈的情况下,全量同步会对源数据库增加约20MB/s的查询压力,以及占用2~4个CPU。

使用须知

DRS全量+增量同步过程一般包含四个阶段:任务启动阶段、全量阶段、增量阶段、结束任务阶段(单全量任务则包含三个阶段)。为了确保同步各个阶段的平顺,在创建同步任务前,请务必阅读以下使用须知。

表3 使用须知

类型名称

使用和操作约定

任务启动前须知

  • 源数据库要求:
    • 源库必须是本云GeminiDB Redis实例。
    • 一个GeminiDB Redis实例只能同时作为一个DRS任务的源端数据库。
    • 源数据库GeminiDB Redis内核版本(gemini version)为4.2.0及以上。
    • notify-keyspace-events 配置项开启通知过期事件互斥,如需使用同步功能,需关闭 通知过期事件的功能.
    • 创建全量+增量任务,需要支持PSYNC命令。
    • 源数据库GeminiDB Redis需要开启复制功能。
      set config set enable-replication 1。
  • 目标数据库要求:
    • 同步前目标库建议为空。
    • 目标数据库实例必须有足够的存储空间。
    • 暂不支持Redis 6.0版本填写用户名。
    • 如果目标库是通过容器、云服务器、或NAT等方式创建的集群,请保证集群的config设置可以使DRS发现全部的主备节点。
  • 其他使用须知:
    • 全量+增量任务使用解析RDB的方式读取数据。
    • 如果源库GeminiDB Redis复制功能超时时间repl-timeout过小(当前默认是3600s),可以适当进行扩大,防止任务失败时间过长,导致任务无法续传。
    • 同步过程中,如果源库GeminiDB Redis增配导致任务失败,需要重置任务。且为保障数据一致性,在重置任务前,建议先清空已迁移至目标的数据。(任务增量中且源库内核版本(gemini version)6.3.0及以上无需重置)
    • 同步过程中,不支持源库GeminiDB Redis减配,如果源库需要减配,请重新创建同步任务。(任务增量中且源库内核版本(gemini version)6.3.0及以上无需重置)
    • 对于List对象,由于在调用PSYNC进行重传时,不会对目标端已有的数据进行清空,可能导致出现重复数据。
    • 源库GeminiDB Redis为主备版时,不支持在源库执行包含多个key的命令(例如mset等),否则可能因为key不在同一个slot或者涉及多个slot,导致报错:CROSSSLOT Keys in request don't hash to the same slot。

全量同步阶段须知

  • 同步过程中,不允许修改连接源和目标数据库的密码,或修改源和目标数据库的端口号。
  • 同步过程中,不允许对正在同步中的目标数据库进行修改操作。

增量同步过程须知

  • 同步过程中,不允许修改连接源和目标数据库的密码,或修改源和目标数据库的端口号。
  • 同步过程中,不允许对正在同步中的目标数据库进行修改操作。

前提条件

操作步骤

本章节将介绍在公网网络场景下,通过数据复制服务配置GeminiDB Redis同步至Redis集群的任务流程。

  1. 在“实时同步管理”页面,单击“创建同步任务”。
  2. 在“同步实例”页面,填选区域、项目、任务名称、描述、同步实例信息,单击“开始创建”

    • 任务信息
      图1 同步任务信息
      表4 任务和描述

      参数

      描述

      区域

      当前所在区域,可进行切换。

      项目

      当前区域对应的项目,可进行切换。

      任务名称

      任务名称在4到50位之间,必须以字母开头,可以包含字母、数字、中划线或下划线,不能包含其他的特殊字符。

      描述

      描述不能超过256位,且不能包含! = < > & ' " \ 特殊字符。

    • 同步实例信息
      图2 同步实例信息

      表5 同步实例信息

      参数

      描述

      数据流动方向

      选择“出云”

      出云指源端数据库为本云数据库。

      源数据库引擎

      选择“GeminiDB Redis”。

      目标数据库引擎

      选择“Redis集群”

      网络类型

      此处以“公网网络”为示例。可根据业务场景选择“公网网络”“VPC网络”“VPN、专线网络”

      • VPC网络:适合云上同账号同Region同VPC场景下数据库之间的同步。
      • 公网网络:适合通过公网网络把其他云下或其他平台的数据库同步到目标数据库,该类型要求数据库绑定弹性公网IP(EIP)。
      • VPN、专线网络:适合VPN、专线、CC、VPCEP、或者用户已打通VPC对等连接的网络场景,实现其他云下自建数据库与云上数据库同步、云上同Region跨账号、或云上跨Region的数据库之间的同步。

      源数据库实例

      用户所创建的源GeminiDB Redis实例。

      同步实例所在子网

      请选择同步实例所在的子网。也可以单击“查看子网”,跳转至“网络控制台”查看实例所在子网帮助选择。

      默认值为当前所选数据库实例所在子网,请选择有可用IP地址的子网。为确保同步实例创建成功,仅显示已经开启DHCP的子网。

      同步模式

      • 增量:增量同步通过解析日志等技术,将源端产生的增量数据同步至目标端。
      • 全量+增量:该模式为数据库持续性同步,适用于对业务中断敏感的场景,通过全量同步过程完成目标端数据库的初始化后,增量同步阶段通过解析日志等技术,将源端和目标端数据库保持数据持续一致。
        说明:

        选择“全量+增量”同步模式,增量同步可以在全量同步完成的基础上实现数据的持续同步,无需中断业务,实现同步过程中源业务和数据库继续对外提供访问。

      DRS任务数

      DRS任务数量代表DRS进行迁移的节点数量,源端2到3个分片可以使用一个DRS任务。源库GeminiDB Redis为主备版时,DRS任务数只能为1。

      指定公网IP

      网络类型选择“公网网络”时可见,选择为DRS实例绑定的弹性公网IP。任务创建时,DRS将会自动绑定该弹性公网IP,等待任务结束后将自动解绑该弹性公网IP。指定公网IP数量需要与实例数量匹配。

      公网网络迁移产生的数据传输费用收取标准请参见:弹性公网IP价格计算器

    • 可用区
      图3 可用区
      表6 任务可用区

      参数

      描述

      可用区

      DRS任务创建的可用区,选择跟源或目标库相同的可用区性能更优。

    • 企业项目和标签
      图4 企业项目和标签

      表7 企业项目和标签

      参数

      描述

      企业项目

      企业项目是一种云资源管理方式,企业项目管理服务提供统一的云资源按项目管理,以及项目内的资源管理、成员管理。请在下拉框中选择所在的企业项目,其中,default为默认项目。

      更多关于企业项目的信息,请参见《企业管理用户指南》

      如果需要自定义企业项目,请在控制台右上角单击“企业”,进入“企业项目管理”页面创建,具体请参见《企业管理用户指南》中“创建企业项目”的内容。

      标签

      • 可选配置,对同步任务的标识。使用标签可方便管理您的任务。每个任务最多支持20个标签配额。
      • 如果您的组织已经设定DRS的相关标签策略,则需按照标签策略规则为任务添加标签。标签如果不符合标签策略的规则,则可能会导致任务创建失败,请联系组织管理员了解标签策略详情。
      • 任务创建成功后,您可以单击任务名称,在“标签”页签下查看对应标签。关于标签的详细操作,请参见标签管理

    对于创建失败的任务,DRS默认保留3天,超过3天将会自动结束任务。

  3. 在“源库及目标库”页面,同步实例创建成功后,填选自建DNS服务配置、源库信息和目标库信息,单击“源库和目标库”处的“测试连接”,分别测试并确定与源库和目标库连通后,勾选协议,单击“下一步”

    • 自建DNS服务配置
      图5 自建DNS服务器
      表8 自建DNS信息

      参数

      描述

      是否配置自建DNS服务器

      当用户需要填写自建的内网域名数据库地址作为源或者目标进行数据同步时,请开启此选项。

      自建DNS服务IP

      填写用户自建的DNS服务IP信息。

      配置自建DNS服务IP后,用户可在源库或目标库的“IP地址或域名”处填写您自建的内网域名数据库地址进行数据同步。

      自建DNS功能目前仅支持白名单用户,需要提交工单申请才能使用。您可以在管理控制台右上角,选择“工单 > 新建工单”,完成工单提交。

    • 源库信息
      图6 源库信息页面
      表9 源库信息

      参数

      描述

      数据库实例名称

      默认为创建迁移任务时选择的GeminiDB Redis实例,不可进行修改。

      数据库密码

      源数据库的管理员密码。

      源数据库的IP地址或域名和密码,会被系统加密暂存,直至删除该迁移任务后自动清除。

    • 目标库信息配置
      图7 目标库信息
      表10 目标库信息

      参数

      描述

      IP地址或域名

      目标数据库的IP地址或域名,格式为IP地址/域名:端口。

      请填写Redis集群所有主从节点的IP和对应端口,最多支持填写32个IP地址或域名,多个值之间请用英文逗号隔开。例如192.168.0.1:8080,192.168.0.2:8080。

      数据库密码

      目标数据库的登录密码。

      目标数据库的密码将在同步过程中被加密暂存到数据库和同步实例主机上,待该任务删除后会永久清除。

  4. “同步设置”页面,设置迁移对象,单击“下一步”

    图8 设置同步对象
    表11 同步对象

    参数

    描述

    同步对象

    目前仅支持全部同步。

  5. “预检查”页面,进行同步任务预校验,校验是否可进行同步。

    • 查看检查结果,如有不通过的检查项,需要修复不通过项后,单击“重新校验”按钮重新进行同步任务预校验。

      预检查不通过项处理建议请参见《数据复制服务用户指南》中的“预检查不通过项修复方法”。

    • 预检查完成后,且预检查通过率为100%时,单击“下一步”。

      所有检查项结果均通过时,若存在请确认项,需要阅读并确认详情后才可以继续执行下一步操作。

  6. “任务确认”页面,设置同步任务的启动时间、任务异常通知设置、SMN主题、时延阈值、任务异常自动结束时间,并确认同步任务信息无误后,单击“启动任务”,提交同步任务。

    图9 任务启动设置

    表12 任务启动设置

    参数

    描述

    启动时间

    同步任务的启动时间可以根据业务需求,设置为“立即启动”或“稍后启动”,优选“稍后启动”。

    说明:

    预计同步任务启动后,会对源数据库和目标数据库的性能产生影响,建议您将任务启动时间设定在业务低峰期,同时预留2-3天校对数据。

    任务异常通知设置

    该项为可选参数,开启之后,选择对应的SMN主题。当入云同步任务即将开始计费或者同步任务状态、时延指标、数据等异常时,系统将发送通知。

    SMN主题

    “任务异常通知设置”项开启后可见,需提前在SMN上申请主题并添加订阅。

    SMN主题申请和订阅可参考《消息通知服务用户指南》

    时延阈值

    在增量同步阶段,源数据库和目标数据库之间的同步有时会存在一个时间差,称为时延,单位为秒。

    时延阈值设置是指时延超过一定的值后(时延阈值范围为0到3600s),DRS可以发送告警通知。告警通知将在时延稳定超过设定的阈值6min后发送,避免出现由于时延波动反复发送告警通知的情况。

    说明:
    • 首次进入增量同步阶段,会有较多数据等待同步,存在较大的时延,属于正常情况,不在此功能的监控范围之内。
    • 设置时延阈值之前,需要设置任务异常通知。
    • 当时延阈值设置为0时,不会发送通知给收件人。

    数据异常通知

    该项为可选参数,开启之后,当同步任务数据异常时,系统将发送通知。

    任务异常自动结束时间(天)

    设置任务异常自动结束天数,输入值必须在14到100之间,默认值14。

    说明:

    异常状态下的任务仍然会计费,而长时间异常的任务无法续传和恢复。设置任务异常自动结束天数后,异常且超时的任务将会自动结束,以免产生不必要的费用。

  7. 同步任务提交后,您可在“实时同步管理”页面,查看并管理自己的任务

    • 您可查看任务提交后的状态,状态请参见任务状态说明
    • 在任务列表的右上角,单击刷新列表,可查看到最新的任务状态。
    • 对于未启动、状态为配置中的任务,DRS默认保留3天,超过3天DRS会自动删除后台资源,当前任务状态不变。当用户再次配置时,DRS会重新申请资源,此时DRS任务IP会发生改变。
    • 对于公网网络类型的任务,由于DRS需要在任务结束后删除后台资源,所以该任务绑定的弹性公网IP需要等待一段时间,才能恢复为解绑状态。