# 安装补丁
#### 安装补丁
1. 登录[MRS管理控制台](https://console.huaweicloud.com/mrs/)。
2. 选择"现有集群"，选中需要安装补丁的集群并单击集群名，进入集群基本信息页面。
3. 进入"补丁管理"页面，在操作列表中单击"安装"。
4. 进入"安装补丁"页面，阅读补丁说明，并单击"确定"。 
   图1安装补丁   
   ![](https://support.huaweicloud.com/usermanual-mrs/zh-cn_image_0000002577762512.png "点击放大")
   - 请确保集群允许**root** 登录，并且所有节点的**root**密码一致。
   
   - 如果任务失败，选择"重试安装"，只有当"状态"显示为"已安装"时，才能进入下一步操作。
   
   
   
   - 升级安装失败或者重试后仍然失败，不能直接回滚，请联系运维人员。
   
   
   
   
 
#### 修改配置
针对**存算分离且集群已配置委托场景**，解决使用JobGateway组件提交Spark长稳任务偶现OBS 403问题：
登录Manager页面，选择"集群 \> 服务 \> JobGateway \> 配置 \> 全部配置"，在JobServer角色自定义配置项"jobserver.application.customized.configs"中增加配置参数"jobgateway.spark.launcher.obs.user-agency.enabled"，值为"true"，保存配置并滚动重启JobServer实例。
#### 重启相关组件
补丁安装完成后，需要手动重启相关大数据组件服务，使补丁生效。
提供两种重启方式，请根据业务自行选择重启方式：
- 滚动重启：影响小，耗时长。
- 离线重启：会断服，耗时短。
1. 登录MRS管理控制台或FusionInsight Manager界面。
2. 重启相关组件，可以采用重启集群或者重启组件方式。 
   - 方式一（推荐）：重启集群，建议在业务空闲时间重启。 在FusionInsight Manager界面，选择"主页 \> 更多 \> 重启"，重启集群或者滚动重启集群，具体操作请参考[重启MRS集群](https://support.huaweicloud.com/usermanual-mrs/mrs_01_0579.html)。
     
   
   - 方式二：重启组件，必须按照[表1]中列出来的组件顺序，依次重启组件。
     在FusionInsight Manager界面重启组件：选择"集群 \> 服务 \> *待操作的服务名称*"，单击右上角的"更多"，选择"重启服务"或"滚动重启服务"。
     在MRS控制台重启组件：选择"现有集群"，单击集群名称进入集群详情页面。单击"组件管理"，选择需要重启的服务，进入服务页面。在"服务状态"页签单击"更多"，选择"重启服务"或"滚动重启服务"。
     
   
   
   如果是跨补丁版本升级，需要重启的组件为各版本重启组件的合集。
   升级路径不一样重启的组件不一样，详见[表1]。
    表1重启组件 
   | 集群当前补丁版本           | 目标补丁版本                | 重启的组件                                                                                                                                                                                                                     |
   |:---|:---|:---|
   | MRS 3.3.0-LTS.1 | MRS 3.3.0-LTS.1.2 | 建议重启集群，如果重启组件，请按照组件的顺序依次重启，涉及的组件有： ZooKeeper,HDFS,Yarn,Mapreduce,Ranger,Hive,Spark,HBase,Flink,Flume,Loader,ClickHouse,HetuEngine,JobGateway,Kafka,Guardian,Oozie,Tez, HetuEngine计算实例 |
      
   表2重启策略以及影响 
   | **组件**                  | **重启策略**  | **影响范围**                                                                                                                                                                                                                                                                             | **影响时间**                                |
   |:---|:---|:---|:---|
   | ZooKeeper           | 直接重启   | 直接重启业务会中断                                                                                                                                                                                                                                                                        | 直接重启耗时约5分钟                            |
   | ZooKeeper           | 滚动重启 | 滚动重启前请分析集群。ZooKeeper客户端连接数规格是否满足"maxCnxns"、"maxClientCnxns"参数配置要求，否则适当调整参数值使满足系统要求。可以通过各quorumpeer实例"ZooKeeper服务客户端资源连接状况"监控值分析，当规格不满足要求时，增大如上服务端参数配置值即可。                                                                                                                          | 滚动重启3个节点耗时约15分钟。                      |
   | HDFS                    | 直接重启      | 重启期间无法进行HDFS读写，影响上层组件与作业                                                                                                                                                                                                                                                             | 直接重启耗时约10分钟                             |
   | HDFS                    | 滚动重启      | 组件HDFS开始重启到组件Yarn重启完成期间，任务有概率失败                                                                                                                                                                                                                                                      | 滚动重启10节点耗时约40分钟                         |
   | Yarn               | 直接重启     | 直接重启期间，不可新提交任务，正在运行Spark、Flink任务有重试机制不受影响                                                                                                                                                                                                                                         | 直接重启耗时约5分钟                           |
   | Yarn               | 滚动重启  | 组件HDFS开始重启到组件Yarn重启完成期间，所有新增作业任务都会失败                                                                                                                                                                                                                                               | 滚动重启10节点耗时约25分钟                    |
   | Mapreduce            | 直接重启  | 重启期间无法访问作业历史页面查看历史任务信息，不影响作业运行                                                                                                                                                                                                                                                  | 直接重启耗时约5分钟                         |
   | Mapreduce            | 滚动重启     | 滚动重启不影响业务                                                                                                                                                                                                                                                                          | 滚动重启耗时约10分钟                         |
   | Ranger              | 直接重启 | 重启期间无法进行鉴权操作，影响需要鉴权的组件或作业                                                                                                                                                                                                                                                        | 直接重启耗时约5分钟                           |
   | Ranger              | 滚动重启    | 滚动重启不影响业务                                                                                                                                                                                                                                                                       | 滚动重启耗时约10分钟                         |
   | Hive                 | 直接重启   | 重启期间无法运行HiveSQL                                                                                                                                                                                                                                                                  | 直接重启耗时约5分钟                            |
   | Hive                 | 滚动重启    | HiveServer滚动重启时，如果仍有客户端连接到滚动重启的HiveServer上，客户端正在运行的任务将失败 重启Hive服务期间，如果仍有客户端连接HiveServer提交任务，可能导致任务运行失败                                                                                                                                           | HiveServer滚动重启时，将等待客户端连接断开，最长等待30分钟 |
   | Spark                   | 直接重启      | 仅影响Spark thrift任务，SparkSQL、Spark Submit任务不受影响                                                                                                                                                                                                                                        | 直接重启耗时约5分钟                              |
   | Spark                   | 滚动重启      | 滚动重启不影响任务                                                                                                                                                                                                                                                                            | 滚动重启2个实例约10分钟                           |
   | HBase                | 直接重启     | 重启期间无法进行HBase数据读写                                                                                                                                                                                                                                                                 | 直接重启耗时约5分钟                           |
   | HBase                | 滚动重启     | 重启时客户端重试连接其他节点，不影响整体服务                                                                                                                                                                                                                                                            | 滚动重启10个节点耗时约30分钟                     |
   | Flink                   | 直接重启      | 仅影响Flink Server任务，Flink Jar、Flink SQL任务不受影响                                                                                                                                                                                                                                          | 直接重启耗时约5分钟                              |
   | Flink                   | 滚动重启      | 不支持滚动重启                                                                                                                                                                                                                                                                              | -                                 |
   | Flume                   | 直接重启      | 停止期间数据流中断，启动后恢复                                                                                                                                                                                                                                                                      | 直接重启耗时约5分钟                              |
   | Flume                   | 滚动重启      | 滚动重启时，重启节点数据流将停止，启动后恢复                                                                                                                                                                                                                                                               | 滚动重启10个节点耗时约30分钟                        |
   | Loader                  | 直接重启      | 重启期间无法提交作业                                                                                                                                                                                                                                                                           | 直接重启耗时约5分钟                              |
   | Loader                  | 滚动重启      | 不支持滚动重启                                                                                                                                                                                                                                                                              | -                                 |
   | Clickhouse           | 直接重启   | 重启时正在运行的任务将失败，重启期间无法提交新任务                                                                                                                                                                                                                                                       | 直接重启耗时约10分钟                         |
   | Clickhouse           | 滚动重启   | 滚动重启时运行在重启实例上的任务将失败，可以向其他节点提交任务                                                                                                                                                                                                                                                 | 10个节点耗时约50分钟                         |
   | HetuEngine            | 直接重启      | 客户端无法访问，但正在运行的业务不受影响。                                                                                                                                                                                                                                                              | 直接重启耗时约5分钟                           |
   | HetuEngine            | 滚动重启     | 不影响业务。                                                                                                                                                                                                                                                                               | 滚动重启10个节点耗时约10分钟                      |
   | JobGateway            | 直接重启    | 重启过程中通过管理控制台提交作业会失败。                                                                                                                                                                                                                                                              | 直接重启耗时约5分钟。                            |
   | JobGateway            | 滚动重启     | 重启过程中通过管理控制台提交作业可能会失败。                                                                                                                                                                                                                                                              | 滚动重启3个节点耗时约10分钟。                     |
   | Kafka                 | 直接重启  | 直接重启业务会中断                                                                                                                                                                                                                                                                          | 直接重启耗时约5分钟。                          |
   | Kafka                 | 滚动重启   | 需要提前查看Broker各实例数据同步正常，可以参考Kafka的监控指标"未完全同步的Partition总数"进行查看。 Kafka滚动重启过程中，建议设置客户端Producer的配置参数"acks"的值为"-1"（配置方式和其他Producer配置参数的配置方式一致），否则在逐个重启Broker实例的瞬间有丢失少量数据的风险。设置"acks"为"-1"在提升数据可靠性的同时会导致Producer吞吐量降低，因此滚动重启完成后，建议恢复Producer的"acks"配置原值。 | 滚动重启10个节点耗时约10分钟。                     |
   | Guardian             | 直接重启   | 请求Guardian失败，任务拿不到访问OBS的aksk                                                                                                                                                                                                                                                      | 直接重启耗时约5分钟                           |
   | Guardian             | 滚动重启   | 滚动重启无影响                                                                                                                                                                                                                                                                            | 滚动重启10个节点耗时约10分钟                    |
   | Oozie                  | 直接重启  | 运行中的任务不受影响，重启期间无法提交新任务                                                                                                                                                                                                                                                            | 直接重启耗时约5分钟                          |
   | Oozie                  | 滚动重启  | 不支持滚动重启                                                                                                                                                                                                                                                                            | -                                   |
   | Tez                   | 直接重启   | 只影响查看任务页面                                                                                                                                                                                                                                                                        | 直接重启耗时约5分钟                           |
   | Tez                   | 滚动重启   | 不支持滚动重启                                                                                                                                                                                                                                                                           | -                                   |
   | HetuEngine计算实例  | 直接重启    | 计算实例重启期间无法执行SQL任务。                                                                                                                                                                                                                                                               | 直接重启耗时约5分钟。                         |
   | HetuEngine计算实例  | 滚动重启  | 不支持滚动重启。                                                                                                                                                                                                                                                                          | -                                    |
      
   
   
 
