文档首页 > > 快速入门> 数据同步> 步骤一:创建同步任务

步骤一:创建同步任务

分享
更新时间: 2020/03/20 GMT+08:00

本小节以MySQL->RDS for MySQL的数据同步为示例,介绍如何使用数据复制服务创建两个数据库实例之间的数据同步任务,其他存储引擎的配置流程类似。

前提条件

操作步骤

  1. 在“数据同步管理”页面,单击“创建同步任务”。
  2. “场景选择”页面,根据分别选择“源数据库来源”“目标数据库来源”后,单击“下一步”进入“同步实例”页面。

    • 入云场景:“源数据库来源”可以为“本云云数据库”“本地自建库”“本云ECS自建库”“其他云上数据库”“目标数据库来源”“本云云数据库”
    • 出云场景:“源数据库来源”“本云云数据库”“目标数据库”可以为“本云云数据库”“本地自建库”“本云ECS自建库”“其他云上数据库”

  3. 在“同步实例”页面,填选任务名称、通知收件人信息、描述、同步实例信息,单击“下一步”。

    图1 同步任务信息
    表1 任务和描述

    参数

    描述

    任务名称

    任务名称在4位到64位之间,必须以字母开头,不区分大小写,可以包含字母、数字、中划线或下划线,不能包含其他的特殊字符。

    任务异常通知设置

    该项为可选参数,开启之后,需要填写手机号码或者邮箱作为指定收件人。当任务状态异常时,系统将发送通知给指定收件人。

    说明:

    收到确认短信或邮件之后,需要在48小时内处理,否则该功能订阅无效。

    时延阈值

    在增量同步阶段,源数据库和目标数据库之间的同步有时会存在一个时间差,称为时延,单位为秒。

    时延阈值设置是指时延超过一定的值后(时间阈值范围为1—3600s),DRS可以发送告警通知给指定收件人。告警通知将在时延稳定超过设定的阈值6min后发送,避免出现由于时延波动反复发送告警通知的情况。

    说明:
    • 首次进入增量同步阶段,会有较多数据等待同步,存在较大的时延,属于正常情况,不在此功能的监控范围之内。
    • 设置时间阈值之前,需要填写收件人手机号或邮箱。

    描述

    描述不能超过256位,且不能包含!=<>&'"特殊字符。

    图2 同步实例信息
    表2 同步实例信息

    参数

    描述

    数据流动方向

    选择“入云”,即目标端数据库为本云数据库。

    源数据库引擎

    选择MySQL。

    目标数据库引擎

    选择MySQL。

    网络类型

    此处以公网网络为示例。

    • 对于MySQL->MySQL的数据同步,可根据业务场景选择公网网络、VPC网络和VPN、专线网络。
    • 对于MySQL->PostgreSQL和PostgreSQL->PostgreSQL场景的数据同步,可根据场景选择VPC网络和VPN、专线网络。

    目标数据库实例

    用户所创建的关系型数据库实例。

    说明:

    目标数据库实例不支持选择只读实例。

    同步类型

    全量+增量

    该模式为数据持续性实时同步,通过全量过程完成目标端数据库的初始化后,增量同步阶段通过解析日志等技术,将源端和目标端数据保持数据持续一致。

    说明:

    选择“全量+增量”同步模式,增量同步可以在全量同步完成的基础上实现数据的持续同步,无需中断业务,实现同步过程中源业务和数据库继续对外提供访问。

    标签

    可选配置,对同步任务的标识。使用标签可方便管理您的数据同步任务。每个任务最多支持10个标签配额。

    任务创建成功后,您可以单击实例名称,在“标签”页签下查看对应标签。关于标签的详细操作,请参见标签管理

  4. 同步实例创建成功后,在“源库及目标库”页面,填选源库信息和目标库信息后,单击“源库和目标库”处的“测试连接”,分别测试并确定与源库和目标库连通后,勾选协议,单击“下一步”

    步骤2中选择的场景不同,源库和目标库需要填选的信息不同,具体以界面为准。
    • 入云场景。
      图3 源库信息
      表3 源库信息

      参数

      描述

      IP地址或域名

      源数据库的IP地址或域名。

      端口

      源数据库服务端口,可输入范围为1~65535间的整数。

      数据库用户名

      源数据库的用户名。

      数据库密码

      源数据库的用户名所对应的密码。支持在任务创建后修改密码。

      任务为启动中、全量同步、增量同步、增量同步失败状态时,可在“基本信息”页面的“同步信息”区域,单击“源库密码”后的“替换密码”,在弹出的对话框中修改密码。

      SSL安全连接

      通过该功能,用户可以选择是否开启对迁移链路的加密。如果开启该功能,需要用户上传SSL CA根证书。

      说明:
      • 最大支持上传500KB的证书文件。
      • 如果不使用SSL证书,请自行承担数据安全风险。

      源数据库的IP地址或域名、数据库用户名和密码,会被系统加密暂存,直至删除该迁移任务后自动清除。

      图4 目标库信息
      表4 目标库信息

      参数

      描述

      数据库实例名称

      默认为创建迁移任务时选择的关系型数据库实例,不可进行修改。

      数据库用户名

      目标数据库对应的数据库用户名。

      数据库密码

      数据库用户名和密码将被系统加密暂存,直至该任务删除后清除。支持在任务创建后修改密码。

      任务为启动中、全量同步、增量同步、增量同步失败状态时,可在“基本信息”页面的“同步信息”区域,单击“目标库密码”后的“替换密码”,在弹出的对话框中修改密码。

    • 出云场景。
      图5 源库信息
      表5 源库信息

      参数

      描述

      数据库实例名称

      默认为创建任务时选择的云数据库实例,不可进行修改。

      数据库用户名

      源数据库对应的数据库用户名。

      数据库密码

      数据库用户名和密码将被系统加密暂存,直至该任务删除后清除。支持在任务创建后修改密码。

      任务为启动中、全量同步、增量同步、增量同步失败状态时,可在“基本信息”页面的“同步信息”区域,单击“源库密码”后的“替换密码”,在弹出的对话框中修改密码。

      图6 目标库信息
      表6 目标库信息

      参数

      描述

      IP地址或域名

      目标数据库的IP地址或域名。

      端口

      目标数据库服务端口,可输入范围为1~65535间的整数。

      数据库用户名

      目标数据库的用户名。

      数据库密码

      目标数据库的用户名所对应的密码。支持在任务创建后修改密码。

      任务为启动中、全量同步、增量同步、增量同步失败状态时,可在“基本信息”页面的“同步信息”区域,单击“目标库密码”后的“替换密码”,在弹出的对话框中修改密码。

      数据库用户名和密码将被系统加密暂存,直至该任务删除后清除。

      SSL安全连接

      通过该功能,用户可以选择是否开启对迁移链路的加密。如果开启该功能,需要用户上传SSL CA根证书。

      说明:

      最大支持上传500KB的证书文件。

  5. “设置同步”页面,选择数据冲突策略和同步对象,单击“下一步”

    图7 同步模式
    表7 同步模式和对象

    参数

    描述

    冲突策略

    数据复制服务提供的数据同步功能使用了主键或唯一键冲突策略,这些策略可以由您自主选择,尽可能保证源数据库中有主键约束或唯一键约束的表同步到目标数据库是符合预期的。

    冲突策略目前支持如下三种形式:

    • 忽略

      当同步数据与目标数据库已有数据冲突时(主键/唯一键存在重复等),将跳过冲突数据,继续进行后续同步。

    • 报错

      当同步数据与目标数据库已有数据冲突时(主键/唯一键存在重复等),同步任务将失败并立即中止。

    • 覆盖

      当同步数据与目标库已有数据冲突时(主键/唯一键重复等),将覆盖原来的冲突数据。

      说明:

      目前仅MySQL->RDS for MySQL的同步场景支持设置“覆盖”冲突策略。

    当数据发生冲突时,针对如下情况,建议选择“忽略”或者“覆盖”,否则建议选择“报错”:

    • 目标数据库存在数据
    • 多对一同步场景
    • 目标数据库手动更新数据

    是否过滤DROP DATABASE

    数据同步过程中,源数据库端执行的DDL操作在一定程度上会影响数据的同步能力,为了降低同步数据的风险,数据复制服务提供了过滤DDL操作的功能。

    目前支持默认过滤删除数据库的操作。

    • 是,表示数据同步过程中不会同步用户在源数据库端执行的删除数据库的操作。
    • 否,则表示数据同步过程中将相关操作同步到目标库。
    说明:

    目前仅MySQL->MySQL的数据同步场景支持过滤DDL操作。

    对象同步范围

    对象同步范围支持索引同步,您可以根据业务需求选择是否进行索引同步。

    同步对象

    同步对象支持库级和表级同步,您可以根据业务场景选择对应的数据进行同步。如果有切换源数据库的操作,请在选择同步对象前单击右上角的,以确保待选择的对象为最新源数据库对象。

    • MySQL->MySQL数据同步支持表级和库级同步。
    • MySQL->PostgreSQL数据同步支持表级同步。
    • PostgreSQL->PostgreSQL数据同步支持库级同步。

    数据同步功能可以支持源数据库和目标数据库中的同步对象(包括数据库、schema、表)的名称不同。如果同步的数据库对象在源数据库和目标数据库中的命名不同,那么可以使用数据复制服务提供的对象名映射功能进行映射。其中包括:库映射、schema映射、表映射。

    对象名映射的具体操作请参考《数据复制服务用户指南》中“对象名映射”章节。

  6. “预检查”页面,进行同步任务预校验,校验是否可进行数据同步。

    • 查看检查结果,如有失败的检查项,需要修复失败项后,单击“重新校验”按钮重新进行任务预校验。

      预检查失败项处理建议请参见《数据复制服务用户指南》中的“预检查失败项修复方法”。

    • 预检查完成后,且所有检查项结果均成功时,单击“下一步”
      图8 预检查

      所有检查项结果均成功时,若存在告警,需要阅读并确认告警详情后才可以继续执行下一步操作。

  7. “任务确认”页面,设置同步任务的启动时间,并确认同步任务信息无误后,勾选协议,单击“启动任务”,提交同步任务。

    • 同步任务的启动时间可以根据业务需求,设置为“立即启动”或“稍后启动”。
    • 预计同步任务启动后,会对源数据库和目标数据库的性能产生影响,建议选择业务低峰期,合理设置同步任务的启动时间。

  8. 同步任务提交后,您可在“数据同步管理”页面,查看并管理自己的任务。

    • 您可查看任务提交后的状态,状态请参见任务状态
    • 在任务列表的右上角,单击刷新列表,可查看到最新的任务状态。

分享:

    相关文档

    相关产品

文档是否有解决您的问题?

提交成功!

非常感谢您的反馈,我们会继续努力做到更好!

反馈提交失败,请稍后再试!

*必选

请至少选择或填写一项反馈信息

字符长度不能超过200

提交反馈 取消

如您有其它疑问,您也可以通过华为云社区问答频道来与我们联系探讨

跳转到云社区