# GPU虚拟化节点弹性伸缩配置
当集群中GPU虚拟化资源不足时，支持自动进行GPU节点的弹性伸缩。本文将指导您如何创建GPU虚拟化节点的弹性伸缩策略。
#### 前提条件
- 已创建一个v1.27及以上版本的集群。
- 在集群中安装[CCE AI套件（NVIDIA GPU）](https://support.huaweicloud.com/usermanual-cce/cce_10_0141.html)（2.1.8、2.7.5及以上版本）、[Volcano调度器](https://support.huaweicloud.com/usermanual-cce/cce_10_0193.html)（1.10.5及以上版本）及[CCE集群弹性引擎](https://support.huaweicloud.com/usermanual-cce/cce_10_0154.html)（1.27.150、1.28.78、1.29.41及以上版本）。
- 集群已在"配置中心 \> 集群弹性伸缩配置 \> 节点扩容条件"中开启"负载无法调度时自动扩容"的开关。
 
#### 约束与限制
- 在算显隔离和显存隔离负载存在于同一节点池时，不支持进行集群内节点池弹性伸缩。如果开启节点池弹性伸缩功能，扩容结果不可控。
- 在多卡均分调度场景下，不支持进行集群内节点池弹性伸缩。如果开启节点池弹性伸缩功能，扩容结果不可控。
 
#### 步骤一：节点池配置
1. 登录[CCE控制台](https://console.huaweicloud.com/cce2.0/?#/cce/cluster/list)，单击集群名称进入集群，在左侧导航栏中选择"节点管理"。
2. 单击"创建节点池"，创建一个GPU虚拟化规格的节点池，操作详情请参见[创建节点池](https://support.huaweicloud.com/usermanual-cce/cce_10_0012.html)。
   
   关于GPU虚拟化节点的规格、操作系统、容器运行时、操作系统要求请参见[准备GPU虚拟化资源](https://support.huaweicloud.com/usermanual-cce/cce_10_0645.html)。
   
   
3. 节点池创建完成后，单击"弹性伸缩"，在"伸缩对象"中将目标规格的"弹性伸缩"按钮开启，然后单击"确定"进行保存。
 
#### 步骤二：异构资源配置
1. 单击左侧导航栏的"配置中心"，选择"异构资源配置"页签。
2. 在"GPU配置"中找到"节点池配置"，并选择新增的目标节点池。
3. 参考[准备GPU虚拟化资源](https://support.huaweicloud.com/usermanual-cce/cce_10_0645.html)，选择满足GPU虚拟化要求的驱动，并开启支持GPU虚拟化。
   
   - v1.27集群：仅支持集群级别的GPU虚拟化开关。
     图1v1.27集群异构资源配置   
     ![](https://support.huaweicloud.com/usermanual-cce/zh-cn_image_0000002280840826.png "点击放大")
     
     
   
   - v1.28及以上集群：支持节点池级别的GPU虚拟化开关。
     图2v1.28及以上集群异构资源配置   
     ![](https://support.huaweicloud.com/usermanual-cce/zh-cn_image_0000001974886456.png "点击放大") 
   
   
   
   
4. 单击"确认配置"进行保存。
 
#### 步骤三：创建GPU虚拟化负载并扩容
参考[使用GPU虚拟化](https://support.huaweicloud.com/usermanual-cce/cce_10_0646.html)章节，创建使用GPU虚拟化资源的无状态负载，并将GPU申请量设为大于集群现有GPU资源上限。例如：集群中有16GiB显存的资源，假设每个Pod占用1GiB显存，则设置Pod数量为17个，合计17GiB显存。
在等待一小段时间后，可以在节点池详情页面中，可观察到GPU节点的扩容。
#### 相关文档
如果需要通过GPU指标配置工作负载弹性伸缩，请参见[基于GPU监控指标配置工作负载弹性伸缩](https://support.huaweicloud.com/usermanual-cce/cce_10_0844.html)。
