更新时间:2026-07-31 GMT+08:00
放音
播放一段语音或视频,不需要与用户进行交互,例如欢迎语提示音。放音支持8khz * 8bit的wav格式语音文件、TTS文件以及视频文件。
图元样式

图元参数
放音图元的参数如下图所示。

图元参数说明如下:
- 节点名称:在图元上展示的名称,可以根据需要自定义。
- 节点ID:图元节点ID,不可更改。
- 语音提示:当前支持“语音”、“文字转语音”、“视频”、“变量音”、“等待音”五种类型的语音提示。通过单击语音类型前的单选按钮可以选择对应的语音类型。租户级参数“租户是否开启组织间的数据强制隔离机制”开启时,只能选择与画布同组织机构以及无组织机构的数据。
- 语音:wav格式语音文件。目前UAP仅支持8khz * 8bit的wav 格式语音文件。
- 文字转语音:通过文字转语音方式生成的TTS放音文件, 需要已经配置TTS通道。您可以通过开启TTS高级设置,设置放音参数。单击下拉列表框的按钮可以选择音效和音速。若不开启,默认音效:女生朗读,音速:低速朗读,无TTS扩展参数。
- 音效:选择放音音效,默认“系统默认”音色,可选男生朗读和女生朗读,若选择“系统默认”则以TTS服务器上实际配置的发音人音效为准。
仅MRCP协议对接TTS服务厂商(如科大讯飞、捷通华声)支持。
- 音速:选择放音速度,默认“系统默认”音速,可选低速朗读、中速朗读和高速朗读。若选择“系统默认”则是低速朗读。
仅MRCP协议对接TTS服务厂商(如科大讯飞、捷通华声)支持。
- TTS扩展参数:根据需要定义,字符串长度不超过200。参数值透传到Vendor-Specific-Parameters。
仅MRCP协议对接TTS服务厂商(如科大讯飞、捷通华声)支持。
WebSocket协议对接的TTS服务厂商(如Lodas-Speech TTS)对应的上述高级设置参数以系统管理员在上配置的“发音人”、“音量”、“语速”为准。
- 数字发音方式:当数字的读法根据系统规则无法判断时,需要在放音时指定合成音频时数字是按照数字读法,还是字符串读法。取值范围:系统默认,自动判断,数字,字符串。若选择“系统默认”则以TTS服务器上实际配置的发音方式为准。当前仅Lodas-Speech TTS服务厂商支持。
- 音效:选择放音音效,默认“系统默认”音色,可选男生朗读和女生朗读,若选择“系统默认”则以TTS服务器上实际配置的发音人音效为准。
- 视频:3gp格式的视频文件,且文件大小不超过5MB。
- 放音文件:系统自动根据已选择的语音类型,筛选当前租户下已审核通过的语音文件、TTS放音或者视频,并将符合条件的文件展示在下拉列表框中。您通过单击下拉列表框的箭头按钮可以选择。
- 变量音:通过设置语种、类型和内容自定义放音。
- 语种:选择放音语种。
变量音选择语种非普通话和非英语时,需要联系运维人员定制语法包和语音文件。
- 类型:选择放音类型,支持电话号码、数字、时间(hh:mm:ss)、日期(yyyymmdd)、价格。
- 内容:选择放音内容,请选择全局变量(GLOBAL.*)或流程变量(FLOW.*)定义内容。
如果类型选择为时间和日期,选择的变量格式需和括号中一致。
- 语种:选择放音语种。
- 等待音:用于处理时间比较长的操作,例如接口查询、存储过程处理前先播放等待音乐,然后执行业务处理。不支持数字人场景。
- 放音文件:系统自动根据已选择的语音类型,筛选当前租户下已审核通过的放音文件。
- 放音次数:放音文件循环播放次数,达到播放次数自动停止;有新的放音、呼叫转移、留言操作时,停止播放。
- 单击“保存”,保存当前页配置的所有参数。
分支条件介绍
| 名称 | 含义 | 使用方法 |
|---|---|---|
| 放音失败 | 音频/视频/文本转语音/变量音播放失败 | 播放失败时走该分支。 |
典型使用场景
- 语音转IVR流程后,播放欢迎语。
- IVR流程执行过程中或者执行结束前,播放语音提示。
父主题: 图元

