更新时间:2026-07-30 GMT+08:00
分享

多模态输入

华为云码道代码智能体支持上传图像及附件,可将其作为对话上下文融入会话。您可以直接上传或拖拽报错截图、代码截图、技术文档等素材至聊天输入框中,省去冗长文字描述,即可完整清晰还原问题场景,实现精准高效的需求沟通。

约束与限制

表1 约束与限制

限制类别

具体限制

智能体模式

  • 本地目录上传图片:单次可上传1至5张图片,单张图片不超过10MB,总大小不能超过20MB。支持.png、.jpg、.jpeg或.webp格式。
  • 本地目录上传附件:单次可上传1至20个附件,不限制附件大小。支持文件格式:.xls,.xlsx,.csv,.doc,.docx,.ppt,.pptx,.pdf,.md,.mdx,.mdc,.txt,.svg。
  • 在项目目录下拖拽图片或文件

    在华为云码道代码智能体IDE资源管理器的文件树中找到目标图片或文件,直接将其拖入输入框即可完成上传。

智能问答模式

智能问答模式下,仅支持上传本地图片,不支持上传本地附件。

  • 本地目录上传图片:单次可上传1至5张图片,单张图片不超过4MB,总大小不能超过4MB。支持.png、.jpg、.jpeg或.webp格式。
  • 在项目目录下拖拽图片或文件

    在华为云码道代码智能体IDE资源管理器的文件树中找到目标图片或文件,直接将其拖入输入框即可完成上传。

操作系统限制

语音输入功能仅支持在如下操作系统中使用:

  • Windows操作系统:推荐使用Windows 11 (x64);如果使用Windows 10 (x64),系统版本需为2019年及以上,建议升级至最新稳定版本。
  • macOS操作系统:macOS 11及以上版本,兼容ARM64(Apple Silicon)架构。

在会话中上传图片

以在智能体中上传代码片段截图为例,详细说明如何识别图片中的内容。

  1. 切换智能体模式。

    1. 参考快速启动操作,登录华为云码道代码智能体IDE。
    2. 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。

      如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标 ,即可打开华为云码道代码智能体。

  2. 上传图片。

    • 本地目录图片

      单击输入框中的 ,选择“上传图片或附件”,浏览并选择本地图片。您也可以直接将本地图片拖入输入框完成上传。

    • 剪切板图片

      直接在输入框中粘贴,即可将剪切板图片上传。

    • 项目目录图片

      在华为云码道代码智能体IDE资源管理器的文件树中找到目标图片,直接将其拖入输入框即可完成上传。

  3. 查看图片识别结果。

在会话中上传附件

以在智能体中上传pdf格式的附件为例,详细说明如何将附件添加到会话中。

  1. 切换智能体模式。

    1. 参考快速启动操作,登录华为云码道代码智能体IDE。
    2. 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。

      如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标 ,即可打开华为云码道代码智能体。

  2. 单击输入框中的 ,选择“上传图片或附件”,浏览并选择本地附件。
  3. 输入提示词,再单击发送图标 ,智能体便会根据提示词创建并执行任务。

使用语音输入

当不便手动输入文字、需要快速口语表达或难以构建结构化指令时,您可以启用语音输入功能。该功能支持单次最长10分钟的连续录音,能够免去冗长的文字描述,帮助您实现精准、高效的需求沟通。

首次使用时,请确保已开启了麦克风访问权限,如果未开启的,需前往系统设置处理(具体操作界面以实际环境为准)。

  • Windows操作系统:前往开始 > 设置 > 隐私和安全性开启麦克风访问权限
  • macOS操作系统:前往系统设置 > 隐私和安全性,开启麦克风访问权限
  1. 切换智能体模式。

    1. 参考快速启动操作,登录华为云码道代码智能体IDE。
    2. 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。

      如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标 ,即可打开华为云码道代码智能体。

  2. 在聊天界面的输入框下方,单击语音输入图标 ,开始录入语音,AI会将您的语音输入自动转为文字并填入输入框。

    单次输入的语音时长请不要超过10分钟

  3. 语音输入完成后,单击停止语音输入图标 ,再单击发送图标 ,智能体便会根据提示词自动创建任务。

    如果语音识别结果有误,您可以在发送前进行手动编辑。

相关文档