搭建图像理解工作流
场景介绍
用户上传图片,通过AgentArts工作流调用图像理解大模型Qwen2.5-VL-72B,自动识别图片中的可见内容,如建筑特征、自然风光等,并以文字形式返回识别结果。该场景适用于图片内容标注、图片信息提取等应用场景。
前提条件
- 已实名认证的华为账号或IAM用户。
- 已开通AgentArts服务。
- 已开通MaaS模型即服务的Qwen2.5-VL-72B模型。
操作步骤
搭建工作流详细步骤如下:
本工作流每次运行将调用图像理解大模型。图像理解大模型处理图片时,图片会消耗大量token,单次调用费用高于纯文本调用。建议先使用小尺寸图片进行调试,确认工作流正常后再使用正式图片。详情请参见计费说明。
步骤一:创建工作流
步骤二:配置工作流节点
工作流各个核心节点的配置方式如下:
| 节点类型 | 说明 | 示例 |
|---|---|---|
| 开始节点 | 添加1个必选的输入参数,接收用户上传的图片。
|
|
| 大模型节点 | 该节点利用图像理解模型对图片进行内容识别。
|
|
| 结束节点 | 此节点将图片内容输出。
|
|
步骤四:提交版本
- 工作流试运行成功后,在工作流编排页面,单击右上角“提交版本”。
- 输入版本号与版本描述,如图6所示。
相关文档
常见问题
Q:报错“AgentArts.102056”,如何处理?
检查输出参数的类型与提示词要求的类型是否一致。如果不一致,请同时调整参数类型和提示词中要求输出的类型,使二者匹配,从而解决该问题。









