部署与接入模型
本章节将使用模型优化中的“部署与接入”能力,将训练好的模型替换到智能体中。
部署与接入分为以下几个阶段:(1)将模型快照部署为推理服务(部署完成后模型处于“运行中”状态,可接收推理请求);(2)将推理服务接入到智能体中替换原模型(需单击“应用至智能体”,替换智能体中的原模型);(3)将智能体进行更新版本操作,模型才会正式应用到智能体中。
- 在“模型优化”页面单击优化任务名称,在模型快照列表中,选择您需要查看的快照。
- 单击操作列的“部署并接入”,将该模型替换到Agent中。 图1 查看模型产物
- 在“模型部署与接入”页面分别配置模型部署资源、配置接入信息。
- 部署资源配置:
表1 部署资源配置参数说明 参数
说明
资源池类型
资源池分为公共资源池与专属资源池。
- 公共资源池:由AgentArts平台提供的公共部署资源,开箱即用,适合首次验证,无需提前购买资源。按资源规格、使用时长及实例数计费,详见ModelArts计费说明。
- 专属资源池:由用户自己在ModelArts平台创建的专属资源池,独享部署资源,适合生产环境长期使用。
在ModelArts平台创建专属资源池时,需要选择“模型部署”场景的资源池,并选择“NPU+ARM”架构的节点规格。详细指导请参考创建专属资源池。
图2 在ModelArts中购买专属资源池
图3 在ModelArts中购买专属资源池
实例规格
部署模型时从资源池中申请的计算资源,决定了模型能否正常加载、推理速度、单实例承载的并发量。首次验证建议选择最小规格,确认模型可正常加载后,再根据业务并发和响应速度需求按需提升规格。
实例数
同时启动的推理服务副本数量,实例数越多服务能承载的总并发越高。默认值为1,取值范围为1~20。选择专属资源池方式部署时,实例数不可超过专属池的实例数。首次验证建议设置为1。
认证凭据
认证凭据用于获取挂载存储时所需的访问密钥(AK/SK)信息,确保模型部署实例能够正常访问和读取对象存储中的模型文件等资源。单击“前往创建”进行配置:
- 凭据类型:通用凭据
- 凭据名称:可自定义
- 企业项目:默认default
- 设置凭据值:选择“凭据键/值”方式,新增两个键值对,“键”分别填写“accessKeyId”,“secretAccessKey”,值请登录“我的凭证 > 访问密钥”页面获取,获取到的AK和SK就是accessKeyId和secretAccessKey。 图4 获取AK、SK
图5 AK、SK示例
- KMS加密:使用默认配置
- 高级配置:使用默认配置
配置完成后,单击“下一步”保持默认配置,直至凭据创建完成。
图6 创建凭据
- 接入配置:
表2 接入配置参数说明 参数
说明
模型服务名称
为本次部署的推理服务实例起的名字。
模型名称
要部署的具体基础模型名称(如qianwen3),指定推理服务加载哪个模型进行推理。可在模型快照列表中查看对应的基础模型名称。
委托
授权模型部署服务访问您云资源的权限凭证,需要选择一个已创建的IAM信任委托,单击“创建委托”进行创建,配置如下:
- 委托名称:由用户自定义
- 信任主体类型:选择“云服务”
- 云服务:填写“智果Agent自优化模型部署”
- 其他参数:使用默认配置
委托创建完成后,按照页面提示进行授权,授权项选择“AgentArtsRLModelDeploymentAgencyPolicy”。
图7 模型部署与接入
- 部署资源配置:
- 模型部署任务启动后,可以在模型产物列表中查看部署进展。
部署成功显示“运行中”后,单击操作列“应用至智能体”可在对应的智能体中看到,模型已经被替换。
智能体只有经过更新版本重新部署,模型才会被正式应用。
应用模型并更新版本后,智能体中的原模型将被替换。如果智能体已在线上运行,替换可能影响正在进行的业务。建议先在测试环境中验证模型效果,确认无误后再应用到生产环境。如需回滚,可在智能体编辑页面将模型切换回原版本。
图8 应用至智能体
图9 查看智能体中的模型
部署任务列表中会同步展示模型的API接口信息,模型可以直接在智能体中使用,如果需要直接调用模型API接口,可以在ModelArts平台中获取模型部署信息以及API Key信息,相关指导请参考模型调用功能介绍。