多模态输入
华为云码道代码智能体支持上传图像及附件,可将其作为对话上下文融入会话。您可以直接上传或拖拽报错截图、代码截图、技术文档等素材至聊天输入框中,省去冗长文字描述,即可完整清晰还原问题场景,实现精准高效的需求沟通。
约束与限制
| 限制类别 | 具体限制 |
|---|---|
| 智能体模式 |
|
| 智能问答模式 | 智能问答模式下,仅支持上传本地图片,不支持上传本地附件。
|
| 操作系统限制 | 语音输入功能仅支持在如下操作系统中使用:
|
在会话中上传图片
以在智能体中上传代码片段截图为例,详细说明如何识别图片中的内容。
- 切换智能体模式。
- 参考快速启动操作,登录华为云码道代码智能体IDE。
- 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。
如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标
,即可打开华为云码道代码智能体。
- 上传图片。
- 本地目录图片
单击输入框中的
,选择“上传图片或附件”,浏览并选择本地图片。您也可以直接将本地图片拖入输入框完成上传。 - 剪切板图片
直接在输入框中粘贴,即可将剪切板图片上传。
- 项目目录图片
在华为云码道代码智能体IDE资源管理器的文件树中找到目标图片,直接将其拖入输入框即可完成上传。
- 本地目录图片
- 查看图片识别结果。
在会话中上传附件
以在智能体中上传pdf格式的附件为例,详细说明如何将附件添加到会话中。
- 切换智能体模式。
- 参考快速启动操作,登录华为云码道代码智能体IDE。
- 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。
如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标
,即可打开华为云码道代码智能体。
- 单击输入框中的
,选择“上传图片或附件”,浏览并选择本地附件。 - 输入提示词,再单击发送图标
,智能体便会根据提示词创建并执行任务。
使用语音输入
当不便手动输入文字、需要快速口语表达或难以构建结构化指令时,您可以启用语音输入功能。该功能支持单次最长10分钟的连续录音,能够免去冗长的文字描述,帮助您实现精准、高效的需求沟通。
首次使用时,请确保已开启了麦克风访问权限,如果未开启的,需前往系统设置处理(具体操作界面以实际环境为准)。
- Windows操作系统:前往开始 > 设置 > 隐私和安全性,开启麦克风访问权限。
- macOS操作系统:前往系统设置 > 隐私和安全性,开启麦克风访问权限。
- 切换智能体模式。
- 参考快速启动操作,登录华为云码道代码智能体IDE。
- 在聊天界面的输入框下方选择“内置 > 智能体”,切换到智能体模式。右侧显示当前选用的模型,您可在下拉框中切换不同大语言模型。
如果没有正常显示华为云码道代码智能体的聊天窗口,请在顶部菜单栏的右上方,单击展开AI侧栏图标
,即可打开华为云码道代码智能体。
- 在聊天界面的输入框下方,单击语音输入图标
,开始录入语音,AI会将您的语音输入自动转为文字并填入输入框。 单次输入的语音时长请不要超过10分钟。
- 语音输入完成后,单击停止语音输入图标
,再单击发送图标
,智能体便会根据提示词自动创建任务。 如果语音识别结果有误,您可以在发送前进行手动编辑。