
# 在MaaS体验图像理解
在日常工作中，当您需要快速理解图像内容时（如分析产品设计图、解读活动现场照片等），通常会遇到人工处理耗时耗力、细节遗漏和专业门槛等问题。如何高效解决这些问题？MaaS提供图像理解功能，帮助您快速准确地分析图像内容，提高工作效率。
#### 约束限制
- 该功能仅支持"西南-贵阳一"区域。
- 单次对话一次只能发送一张图片，且必须携带文字。图片大小不能超过10MB，图片格式为jpg、jpeg、png或webp。
 
#### 计费说明
使用预置服务或者使用预置服务创建的自定义接入点：统计模型进行实时推理服务时消耗的Token数量，按Token数量付费，详情请参见[图像理解模型计费](https://support.huaweicloud.com/price-maas/price-maas-0005.html)。
#### 前提条件
- 使用预置服务：在"模型推理 \> 在线推理 \> 预置服务"页签，已开通图像理解模型的预置服务。具体操作，请参见[使用预置服务](https://support.huaweicloud.com/model-call-maas/model-call-052.html#ZH-CN_TOPIC_0000002531190674)。
- 使用自定义接入点：在"模型推理 \> 在线推理 \> 自定义接入点"页签，已创建图像理解模型的自定义接入点。具体操作，请参见[创建自定义接入点](https://support.huaweicloud.com/model-call-maas/model-call-048.html)。
 
#### 体验图像理解
1. 登录[MaaS控制台](https://console.huaweicloud.com/modelarts/#/model-studio/homepage)，在顶部导航栏中选择目标区域。
2. 任选以下方式体验图像理解。
   - 方式一
     1. 在左侧导航栏中，选择"模型体验 \> 图像理解"。
     
     2. 在"图像理解"页面左上角单击![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002684244389.png)图标切换模型，在"预置服务"、"自定义接入点"页签，选择要体验的模型服务，单击"确定"。如下图所示：
        ![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002689741329.png "点击放大")
        
        - "预置服务"页签：选择目标服务及版本进行体验。模型列表中的模型包括：已开通模型和未开通模型。 如果选择已开通模型或者切换版本，单击"确认"，完成选择模型或者切换模型。
          如果选择未开通模型，则弹出"开通模型服务"弹框。在弹框中确认"服务名称"、"版本"、"供给方式"、"计费方式"以及"费用评估"等信息后，阅读[《MaaS 模型即服务声明》](https://www.huaweicloud.com/declaration/modelartsstudio.html)后，勾选"我已阅读并同意上述说明，及《MaaS 模型即服务声明》"后，单击"确认"，完成选择模型或者切换模型。
          图1开通模型服务   
          ![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002710104605.png "点击放大") 
        
        - "自定义接入点"页签：选择状态为"使用中"的自定义接入点，单击"确认"，选择自定义接入点完成。
         
      
   
   - 方式二
     1. 在左侧导航栏中，选择"模型推理 \> 在线推理"。
     
     2. 任选以下方式进入"图像理解"页面。
        - 在"预置服务"页签，单击图像理解模型服务操作列的"更多 \> 在线体验"，按需选择版本，进入"图像理解"页面。
        
        - 在"自定义接入点"页签：单击图像理解模型服务操作列的"在线体验"，进入"图像理解"页面。
         
      
   
   - 方式三
     - 选择左侧导航栏"模型广场"，进入"模型广场"页面，单击模型卡片上的"在线体验"按钮，直接进入"图像理解"页面。
      
    
3. （可选）在"图像理解"页面左上方，单击"模型参数"，弹出"参数设置"页面，如下图所示：
   图2设置推理参数   
   ![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002410869260.png "点击放大")
   根据[表1]中的参数说明，您可按需设置推理参数，体验不同的推理效果。如需恢复默认参数，单击"恢复默认"即可。
    表1模型参数设置 
   | 参数             | 说明                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                               |
   |:---|:---|
   | 温度/Temperature | 设置推理温度，**用于控制生成文本的随机性和创造性** ，**Temperature数值越大随机性越大。** - 数值较低，输出结果更加集中和确定。  - 数值较高，输出结果更加随机，更有创意性。   **取值范围**：0\~2 **默认值**：不同模型的默认值不同，请以实际环境为准。                                                                                                                                                                                                                           |
   | 核采样/top_p      | 设置推理核采样，**用于调整输出文本的多样性** 。**top_p数值越大，生成文本的多样性就越高。** - 数值较低，输出可选的tokens类型越少，更有确定性。  - 数值较高，输出可选的tokens类型越多，更有多样性。   **取值范围**：0.1\~1 **默认值**：不同模型的默认值不同，请以实际环境为准。                                                                                                                                                                                           |
   | top_k          | **用于控制输出tokens的多样性**。top_k值越大输出的tokens类型越丰富。选择在模型的输出结果中选择概率最高的前K个结果。 - 数值较低，输出可选的tokens类型越少，更有确定性。  - 数值较高，输出可选的tokens类型越多，更有多样性。   **取值范围**：1\~1000 **默认值**：20 详细解释：top_k可以设置保留概率最高的前K个tokens，从中随机抽取一个token作为最终输出。这种方法可以限制输出序列的长度，并仍然保持样本的一定多样性。 |
      
   
4. 在"图像理解"页面下方，单击![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002410686950.png "点击放大")图标，上传图片（新上传图片将替换原有图片）并输入问题，或者直接使用控制台提供的示例图片，然后单击![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002516479981.png "点击放大")图标发送。
   图3图像理解示例   
   ![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002668436320.png "点击放大")
   
   在模型回答过程中，您可以在对话框单击![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002538558833.png "点击放大")图标，停止模型回答，停止后该对话不产生计费。当模型回答后，您可以单击模型对话框中的![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002444466261.png)图标复制回答，也可以单击![](https://support.huaweicloud.com/model-call-maas/figure/zh-cn_image_0000002444468477.png)图标重新生成回答。
   图像理解支持多轮对话。如果您需要开启新的对话，可以在页面右上角单击"开启新对话"，在"开启新对话"对话框中单击"确定"。开启新对话将清除全部对话，无法保留对话记录。
   
 
