
# 配置模型路由策略
通过配置模型路由策略，您可以将多个已接入的模型服务按规则进行编排，实现模型故障自动切换能力。当主模型因故障、超时或不可用等原因无法正常响应时，系统将根据路由策略自动切换到其他可用模型继续提供服务，从而提升业务的稳定性与可用性。
路由策略创建完成后，可对路由入口进行调测验证，并在智能体中选择使用。
#### 适用场景
- 已接入多个同类型模型服务（例如多个文本对话模型），希望在主模型不可用时自动切换，提升服务连续性。
- 业务对稳定性要求较高，希望降低单一模型服务异常带来的影响。
- 希望在不修改智能体配置的情况下，通过调整路由策略实现模型切换或扩容。
 
#### 前提条件
- 已[接入模型服务](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0191.html)。
- 登录用户为空间所有者、空间管理员、开发工程师、运维工程师，详细信息请参考[管理团队空间成员](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0216.html)。

- 路由中引用的模型服务建议已完成调测，确保模型服务本身可正常调用。 路由策略解决的是"调用入口的高可用"问题，模型调测用于验证"模型服务/路由入口是否可用"。建议先[调测](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0187.html)各模型服务可用性，再配置路由策略并调测路由入口，以便快速定位问题。
  
 
#### 创建路由策略
1. 登录[AgentArts智能体开发平台](https://console.huaweicloud.com/versatile/#/home/overview)，在左侧导航栏"个人空间"区域，选择目标空间。
2. 在左侧导航，选择"开发中心 \> 开发配置"。
3. 选择"路由策略"页签，单击"创建路由策略"。 
   图1创建路由策略   
   ![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002538384468.png)
   
   
4. 在"创建路由策略"页面，配置参数信息，具体参数说明请参考[表1]，配置完成后单击"保存"。
   
   新建的路由策略，显示在路由策略列表中。
   图2创建路由策略   
   ![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002569424157.png)
    表1路由策略参数说明 
   | 参数      | 说明                                                                                                                                                                                                            | 示例                                                                                                                    |
   |:---|:---|:---|
   | 策略名称    | 自定义路由策略的名称。由2\~36个字符组成，包含中英文、数字、中划线（-）、下划线（_）、点（.），仅支持以中英文开头。                                                                                                                                                 | 文本对话路由策略                                                                                                              |
   | AI模型    | 在"模型A"下拉框中选择模型服务。仅支持选择文本对话类型的模型服务。 单击"+ AI模型"，添加模型服务。一共支持添加3个模型服务。 路由策略提供模型服务时，模型调用顺序为：模型A \> 模型B \> 模型C，当模型A无法正常工作时，可以自动依次切换为模型B、模型C。 | 模型A：DeepSeek-R1 模型B：DeepSeek-V3 模型C：Qwen3-32B |
   | 策略总超时时间 | 模型路由策略的总体超时时间。取值范围为1000\~1,000,000ms，默认值为10,000ms。                                                                                                                                                            | 10000ms                                                                                                               |
   | 模型重试次数  | 路由策略中单个模型服务的重试次数。取值范围为0-100次，默认值为0次。                                                                                                                                                                          | 0                                                                                                                     |
   | 策略描述    | 路由策略的描述信息。由1\~100个字符组成。                                                                                                                                                                                       | 该策略为文本对话类型的路由策略。                                                                                                      |
      
   
   
5. 在"模型调测"区域，调测模型，具体参数说明请参考[表2]。
   
   图3调测模型   
   ![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002569424153.png)
    表2模型调测参数说明 
   | 参数名称       | 参数说明                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       | 示例   |
   |:---|:---|:---|
   | 输出方式       | 可选非流式、流式。 - **非流式**：调用大语言模型推理服务时，根据用户问题，获取大语言模型的回答，大语言模型完整生成回答后一次性返回。  - **流式** ：调用大语言模型推理服务时，根据用户问题，获取大语言模型的回答，逐个字词的快速返回模式，不需等待大语言模型生成完成。默认**流式**。   | 流式   |
   | 输出最大token数 | 模型在单次推理或生成内容时，能够输出的token（模型处理文本的基本单位）数量的最大值。取值范围为100\~32768，默认值为2048。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                      | 2048 |
   | 温度         | 较高的数值会使输出更加随机，而较低的数值会使其更加集中和确定。取值范围0.01\~2，默认值为0.5。 建议该参数和"多样性"只设置1个。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                  | 0.5  |
   | 多样性        | 影响输出文本的多样性，取值越大，生成文本的多样性越强。取值范围0\~1，默认值为0.5。 建议该参数和"温度"只设置1个。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                        | 0.5  |
   | 存在惩罚       | 正值会尽量避免使用已出现过的词语，更倾向于生成新词语。取值范围-2.0\~2.0，默认值为0。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            | 0    |
   | 频率惩罚       | 正值会尽量避免使用常见的单词和短语，更倾向于生成较少见的单词。取值范围-2.0\~2.0，默认值为0。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                        | 0    |
      
   
   
6. 在右侧"预览调试"区域，在对话输入框输入测试语句后按Enter键或单击![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002538544414.png)，查看模型响应结果。
   
   单击![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002538384480.png)，清除本次会话内容，可以开始新的会话。
   图4预览调试   
   ![](https://support.huaweicloud.com/usermanual-agentarts0/zh-cn_image_0000002538384472.png)
   
   
 
#### 相关操作
在"路由策略"列表，支持的其他操作请参考[表3]。
 表3相关操作 
| 操作       | 说明                             |
|:---|:---|
| 查看路由策略详情 | 在待查看的路由策略对应的"策略名称"列下，单击路由策略名称。 |
| 修改路由策略   | 在待修改的路由策略对应的"操作"列下，单击"编辑"。     |
| 删除路由策略   | 在待删除的路由策略对应的"操作"列下，单击"删除"。     |
   
#### 相关文档
路由策略创建完成后，用户可在智能体、工作流中使用路由策略，请参考[开发单智能体应用](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0011.html)、[开发工作流应用](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0040.html)、[开发多智能体应用](https://support.huaweicloud.com/usermanual-agentarts0/agentarts_05_0102.html)。
