# 语音交互服务 SIS > 提供语音识别、合成功能 ## 服务公告 - [产品公告](https://support.huaweicloud.com/prod-bulletin-sis/index.md): 产品公告 ## 产品介绍 - [什么是语音交互服务](https://support.huaweicloud.com/productdesc-sis/sis_01_0001.md): 语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API获取语音交互结果。例如用户通过语音识别功能,将口述音频或者语音文件识别成可编辑的文本,同时也支持通过语音合成功能将文本转换成逼真的语音等提升用户体验。适用场景如语音客服质检、会议记录、语音短消息、有声读物、电话回 - [功能介绍](https://support.huaweicloud.com/productdesc-sis/sis_01_0017.md): 实时语音识别服务,用户通过实时访问和调用API获取实时语音识别结果,支持的语言包含中文普通话、方言和英语,方言当前支持四川话、粤语和上海话。文本时间戳为音频转换结果生成特定的时间戳,从而通过搜索文本即可快速找到对应的原始音频。为音频转换结果生成特定的时间戳,从而通过搜索文本即可快速找到对应的原始音频。智能断句通过提取上下文相关语义特征,并 - [应用场景](https://support.huaweicloud.com/productdesc-sis/sis_01_0002.md): 语音客服质检识别客服、客户的语音,转换为文本。进一步通过文本检索,检查有没有违规、敏感词、电话号码等信息。识别客服、客户的语音,转换为文本。进一步通过文本检索,检查有没有违规、敏感词、电话号码等信息。会议记录对会议记录的音频文件,进行快速的识别,转化成文字,方便进行会议记录。对会议记录的音频文件,进行快速的识别,转化成文字,方便进行会议记 - [计费说明](https://support.huaweicloud.com/productdesc-sis/sis_01_0020.md): 一句话识别、语音合成按调用次数计费;实时语音识别、录音文件识别按音频时长计费;录音文件识别极速版按照“音频时长×需要识别的音频声道数“计费,时长计算精确到秒;声音复刻按照字符数进行计费。按音频时长计费的,累加每次调用的音频时长。按调用次数计费的,返回失败的调用不计入次数。按字符数计费的,合成失败的字符不计入总字符数。调用热词接口,不单独计 - [与其他云服务的关系](https://support.huaweicloud.com/productdesc-sis/sis_01_0004.md): SIS服务与周边其他服务的关系如图1所示。统一身份认证(Identity and Access Management,简称IAM)服务,IAM为语音交互服务提供了用户认证和鉴权功能。SIS服务接口支持从对象存储服务(Object Storage Service,OBS)上采用临时授权和匿名公开授权的方式获取数据并进行处理。录音文件识别支持 - [实时语音识别](https://support.huaweicloud.com/productdesc-sis/sis_01_0008.md): 支持华北-北京四、华东-上海一区域。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域,支持一句话识别、录音文件识别、实时语音识别和语音合成和热词等接口。华东-上海一,推荐的区域,支持一句话识别、录音文件识别、实时语音识别、语音合成和热词等接口。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四 - [一句话识别](https://support.huaweicloud.com/productdesc-sis/sis_01_0011.md): 支持华北-北京四、华东-上海一区域。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域,支持一句话识别、录音文件识别、实时语音识别和语音合成和热词等接口。华东-上海一,推荐的区域,支持一句话识别、录音文件识别、实时语音识别、语音合成和热词等接口。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四 - [录音文件识别](https://support.huaweicloud.com/productdesc-sis/sis_01_0018.md): 支持华北-北京四、华东-上海一区域。当前语音服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域。华东-上海一,推荐的区域。当前语音服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域。华东-上海一,推荐的区域。支持pcm16k16bit、pcm8k16bit、ulaw16k8bit、ulaw8 - [语音合成](https://support.huaweicloud.com/productdesc-sis/sis_01_0012.md): 支持华北-北京四、华东-上海一区域。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域,支持一句话识别、录音文件识别、实时语音识别和语音合成和热词等接口。华东-上海一,推荐的区域,支持一句话识别、录音文件识别、实时语音识别、语音合成和热词等接口。当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四 - [声音复刻](https://support.huaweicloud.com/productdesc-sis/sis_01_0052.md): 仅支持华东-上海一区域。一个用户最多注册1000个声音。支持使用预置音色或注册声音合成语音。会话中如果出现错误或严重的错误,系统会舍弃待合成的文本,只计费已合成的文本。支持采样率8kHz,16kHz,24kHz,默认16kHz。https接口,支持待合成文本长度不超过300字符。https接口支持合成wav、mp3、pcm格式的音频。流式 - [录音文件识别极速版](https://support.huaweicloud.com/productdesc-sis/sis_01_0021.md): 支持华北-北京四、华东-上海一区域。当前语音服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域。华东-上海一,推荐的区域。当前语音服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域。华东-上海一,推荐的区域。支持wav、mp3、m4a、aac、opus格式音频文件。语音时长不超过120分钟, - [语音交互服务的监控指标](https://support.huaweicloud.com/productdesc-sis/sis_01_0023.md): 本节定义了语音交互服务上报云监控服务的监控指标的命名空间,监控指标列表和维度定义,用户可以通过云监控服务提供管理控制台来检索SIS服务产生的监控指标和告警信息。SYS.SIS - [查看监控指标](https://support.huaweicloud.com/productdesc-sis/sis_01_0014.md): 登录控制台。在服务页面单击左侧的总览,进入服务监控页面。服务监控 - [责任共担](https://support.huaweicloud.com/productdesc-sis/sis_01_0045.md): 华为云秉承“将公司对网络和业务安全性保障的责任置于公司的商业利益之上”。针对层出不穷的云安全挑战和无孔不入的云安全威胁与攻击,华为云在遵从法律法规业界标准的基础上,以安全生态圈为护城河,依托华为独有的软硬件优势,构建面向不同区域和行业的完善云服务安全保障体系。与传统的本地数据中心相比,云计算的运营方和使用方分离,提供了更好的灵活性和控制力 - [身份认证与访问控制](https://support.huaweicloud.com/productdesc-sis/sis_01_0046.md): 用户访问SIS的方式有多种,包括SIS控制台、API、SDK,无论访问方式封装成何种形式,其本质都是通过SIS提供的API接口进行请求。SIS的接口有如下两种认证方式,您可以选择其中一种进行认证鉴权。Token认证:通过Token认证调用请求。AK/SK认证:通过AK(Access Key ID)/SK(Secret Access Key - [数据保护技术](https://support.huaweicloud.com/productdesc-sis/sis_01_0047.md): 在使用语音交互服务过程中委托我们处理的语音音频和文本等数据,您完全拥有上述数据所有权及控制权,您应自行对上述数据来源和获取的合法性负责,华为云受托处理您的数据,以实现本服务功能或目的:(1)将语音音频数据识别转换成文本。(2)将文本数据合成语音。您的上述数据将在中华人民共和国境内处理,处理完后立即删除,华为云不会保存以上数据。SIS通过多 - [服务韧性](https://support.huaweicloud.com/productdesc-sis/sis_01_0049.md): 华为云数据中心按规则部署在全球各地,所有数据中心都处于正常运营状态,无一闲置。数据中心互为灾备中心,如一地出现故障,系统在满足合规政策前提下自动将客户应用和数据转离受影响区域,保证业务的连续性。为了减少由硬件故障、自然灾害或其他灾难带来的服务中断,华为云为所有数据中心提供灾难恢复计划。SIS提供三级可靠性架构,通过AZ之间容灾、AZ内实例 - [监控安全风险](https://support.huaweicloud.com/productdesc-sis/sis_01_0050.md): SIS提供基于云监控服务CES的监控能力,帮助用户监控账号下的SIS服务API,执行自动实时监控、告警和通知操作。用户可以实时掌握API所产生的调用成功次数、调用失败次数等信息。关于SIS支持的监控指标,以及如何创建监控告警规则等内容,请参见语音交互服务的监控指标。同时,SIS控制台支持监控账号下的SIS服务每个API的用量统计,详情请参 ## 快速入门 - [语音交互服务使用简介](https://support.huaweicloud.com/qs-sis/sis_07_0001.md): 语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API获取语音交互结果。华为云SIS服务支持调用一句话识别、录音文件识别、实时语言识别、语音合成接口等。用户通过调用语音识别类接口,将口述音频、普通话或者带有一定方言的语音文件识别成可编辑的文本,同时也支持通过调用语音 - [调用API实现一句话识别](https://support.huaweicloud.com/qs-sis/sis_07_0003.md): 本章节提供了通过Postman调用一句话识别API的样例,详细介绍如何调用一句话识别API接口,帮助您快速熟悉语音交互服务的使用方法。调用SIS服务的具体操作如下:步骤1:配置环境步骤2:Token认证步骤3:调用一句话识别注册华为账号并开通华为云,并完成实名认证,账号不能处于欠费或冻结状态。语音交互服务的API接口已全部商用,无需开通, - [调用Java SDK实现一句话识别](https://support.huaweicloud.com/qs-sis/sis_07_0002.md): 语音交互服务软件开发工具包(SIS SDK)是对语音交互服务提供的REST API进行的封装,用户直接调用语音交互SDK提供的接口函数即可实现使用语音交互业务能力的目的,以简化用户的开发工作。本章节提供了通过Java SDK调用一句话识别服务的样例,帮助用户快速了解如何使用Java SDK调用华为云SIS服务。具体操作如下所示:步骤1:配 ## 用户指南 - [功能体验与试用](https://support.huaweicloud.com/usermanual-sis/sis_09_0001.md): 语音交互服务(Speech Interaction Service,SIS)支持语音识别、语音合成功能。适用语音客服质检、会议记录、语音短消息、有声读物、电话回访等场景。在使用服务前,请先使用在线体验中心体验服务功能。该方式无需编程,只需在网页端上传文字或音频,即可体验合成效果。使用SIS体验中心前,请先注册华为账号并开通华为云。 - [使用流程简介](https://support.huaweicloud.com/usermanual-sis/sis_09_0002.md): 用户通过调用SIS服务提供的API或SDK,进行语音转文本或语音合成任务,返回的结果需要您通过编码对接到业务系统中。 - [开通语音交互服务](https://support.huaweicloud.com/usermanual-sis/sis_09_0028.md): SIS服务提供如下方式开通服务(当前仅支持北京四和上海一)。登录语音交互服务控制台。在“服务介绍”页面,选择需要使用的服务,单击“开通管理”,执行开通操作,默认的计费方式采用按需计费,不使用不计费。服务开通服务开通成功后,开通状态将显示为“已开通"。服务开通成功后,开通状态将显示为“已开通"。服务开通后,您可以按照官方文档"调用API或S - [关闭语音交互服务](https://support.huaweicloud.com/usermanual-sis/sis_09_0029.md): SIS服务开通后,如不使用,可登录控制台进行关闭。如果您是主账号,也可以控制子用户的服务开通、关闭状态。 - [准备数据](https://support.huaweicloud.com/usermanual-sis/sis_09_0004.md): 受技术与成本多种因素制约,SIS服务存在一些约束限制。详情请参考产品介绍中的约束与限制章节。 - [配置热词表(可选)](https://support.huaweicloud.com/usermanual-sis/sis_09_0005.md): 调用一句话识别、录音文件识别、实时语音识别API时,如果在您的业务领域有一些特有的词,默认识别效果差的时候可以考虑使用热词管理功能,将这些词添加到词表,改善识别效果。创建热词表有两种方式:控制台创建、调用API创建。本章节主要介绍通过控制台创建的方法。登录SIS服务控制台。在左侧导航栏中选择“热词表配置”。并在配置页面单击“创建热词表”。 - [在线调试](https://support.huaweicloud.com/usermanual-sis/sis_09_0007.md): API Explorer在线调试工具提供API的检索、调试、代码示例生成功能。同时,集成开发环境CloudIDE,可完成代码的构建、调试、运行。本章节以语音合成为例,介绍如何使用API Explorer调试API。注册华为账号并开通华为云,并完成实名认证,账号不能处于欠费、冻结、被注销等异常状态。登录API Explorer。登录后,X- - [本地调用](https://support.huaweicloud.com/usermanual-sis/sis_09_0008.md): 本章节以语音合成为例,介绍如何使用SIS Python SDK在本地进行开发。该SDK可以将用户输入的文字合成为音频。通过音色选择,自定义音量、语速,实现个性化音频的生成。注册华为账号并开通华为云,并完成实名认证,账号不能处于欠费、冻结、被注销等异常状态。获取SIS Python SDK。获取并下载SIS Python SDK包,并进行解 - [统计API使用量](https://support.huaweicloud.com/usermanual-sis/sis_09_0009.md): SIS控制台支持查看API的总调用量、调用成功量、调用失败量。 - [应用场景简介](https://support.huaweicloud.com/usermanual-sis/sis_09_0011.md): SIS支持通过企业项目管理(EPS)对不同用户组和用户的资源使用,进行分账。企业可以根据组织架构规划不同的企业项目,并为每个企业项目设置拥有不同权限的用户组和用户,多个企业项目之间相互独立,资源分开结算。企业账号可申请开通企业项目。账号需要进行企业实名认证。如果企业账号注册成为华为云合作伙伴,将无法进入企业项目管理页面。开通企业项目后,企 - [创建企业项目](https://support.huaweicloud.com/usermanual-sis/sis_09_0012.md): 创建企业项目的用户必须是管理员,或在IAM侧已被授予EPS FullAccess权限的用户。企业账号可申请开通企业项目。账号需要进行企业实名认证。如果企业账号注册成为华为云合作伙伴,将无法进入企业项目管理页面。登录控制台,单击界面右上方的“企业 > 项目管理”。屏幕分辨率低的情况下单击页面右上方的“更多 > 企业 > 项目管理”。企业项目 - [企业项目财务管理](https://support.huaweicloud.com/usermanual-sis/sis_09_0013.md): 开通了企业项目的客户,可以按企业项目查看各个企业项目的月度消费汇总、消费明细、产品费用走势和费用分布。进入项目管理的“企业项目管理”页面,单击企业项目操作列的“查看消费 ”,查看各企业项目的费用信息。 - [企业项目或删除停用说明](https://support.huaweicloud.com/usermanual-sis/sis_09_0014.md): 用户停用或删除企业项目后,由于云服务的缓存,需要约1小时后生效。因此您可能在停用或删除企业项目后,账单里仍出现该企业项目归集,属于正常现象。不影响您的调用和计费。 - [权限管理](https://support.huaweicloud.com/usermanual-sis/sis_09_0016.md): 如果您需要对华为云上购买的SIS服务,为企业中的员工设置不同的访问权限,以达到不同员工之间的权限隔离,您可以使用统一身份认证服务(Identity and Access Management,简称IAM)进行精细的权限管理。该服务提供用户身份认证、权限分配、访问控制等功能,可以帮助您安全的控制华为云资源的访问。如果华为云账号已经能满足您的 - [创建用户组与IAM用户](https://support.huaweicloud.com/usermanual-sis/sis_09_0017.md): 创建用户组使用主账号登录IAM服务控制台。左侧导航窗格中,选择“用户组”页签,单击右上方的“+创建用户组”。创建用户组在“创建用户组”界面,输入“用户组名称”,创建用户组。返回用户组列表,单击列表中的“授权”。勾选需要授予用户组的权限,单击“确定”,完成用户组授权。用户组授权搜索相关服务。此处选择“SIS”,并为该用户组设置所需的权限。S - [为IAM用户分配权限](https://support.huaweicloud.com/usermanual-sis/sis_09_0018.md): 为IAM用户分配权限IAM用户自行开通SIS服务使用主账号登录IAM服务控制台打开用户组列表,找到子用户所在的用户组,单击该用户组的“授权”操作。勾选需要授予用户组的权限,单击“确定”,完成用户组授权。SIS全部系统权限请参见权限管理。用户组授权当现有策略不满足时,可使用SIS自定义策略自定义策略当现有策略不满足时,可使用SIS自定义策略 - [IAM用户登录并验证权限](https://support.huaweicloud.com/usermanual-sis/sis_09_0019.md): 使用新创建的IAM账户登录控制台,切换至授权区域,进行验证权限。假设IAM用户只具备“SIS ReadOnlyAccess”权限,即只读访问权限,使IAM用户仅具备使用服务能力,开通/关闭服务需要主账户操作。进入SIS控制台界面,单击“开通服务”,如果无法开通,提示权限不足,则表示“SIS ReadOnlyAccess”已生效。进入SIS - [SIS自定义策略](https://support.huaweicloud.com/usermanual-sis/sis_09_0020.md): 如果系统预置的权限,不满足您的授权要求,可以创建自定义策略。自定义策略中可以添加的授权项(Action)请参见权限管理。目前华为云支持以下两种方式创建自定义策略:可视化视图创建自定义策略:无需了解策略语法,按可视化视图导航栏选择云服务、操作、资源、条件等策略内容,可自动生成策略。JSON视图创建自定义策略:可以在选择策略模板后,根据具体需 - [方案介绍](https://support.huaweicloud.com/usermanual-sis/sis_09_0022.md): 本方案适用于华为云内网用户,此处的内网用户指的是在华为云购买ECS主机或资源,但未绑定公网弹性IP(EIP)的用户。本方案可以不经过公网也可访问SIS服务,但需要经过内网DNS解析到终端节点(VPCEP),连接APIG所提供的终端节点服务(VPCEP Service),最终调用SIS服务接口,为下图红色箭头所指路径。下图所示红色框内“内网 - [创建终端节点](https://support.huaweicloud.com/usermanual-sis/sis_09_0024.md): 用户登录华为云控制台,单击左上角,输入VPCEP,进入VPC终端节点服务。服务列表进入终端节点服务,点击“购买终端节点”。购买终端节点选择和填写终端节点相关配置并提交购买。区域:选择和SIS业务相同的region。例如SIS业务在华北-北京四,则区域也选择华北北京四。服务类别:选择“按名称查找服务”。服务名称:根据region,按照以下表 - [连通性测试](https://support.huaweicloud.com/usermanual-sis/sis_09_0027.md): 验证需要一台测试机器,要求和现网SIS业务部署节点相同vpc,同时不运行任何业务,避免测试影响实际业务。配置host,将标准域名映射至vpcep的ip地址。执行 vim /etc/hosts 命令,新增一行sis服务标准域名映射。其中左列的ip地址要修改成在创建终端节点中记录的ip地址,右列的域名替换成sis标准域名,取值如下表所示。SI - [创建内网DNS](https://support.huaweicloud.com/usermanual-sis/sis_09_0026.md): 配置内网DNS会将VPC内所有节点访问SIS服务域名解析到VCPEP客户端的内网IP,您的请求进而通过VPCEP通道转发至SIS专享版APIG。请您确认已执行通过了连通性测试,并再次确认您的VPCEP处于“已接受”状态,否则您将可能面临接口调用异常风险!用户登录华为云控制台,单击左上角,输入DNS,进入云解析服务。服务列表单击“内网域名 ## SDK参考 - [SDK简介](https://support.huaweicloud.com/sdkreference-sis/sis_05_0001.md): 语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API获取语音交互结果。支持用户通过语音识别功能,将口述音频、普通话或者带有一定方言的语音文件识别成可编辑的文本,同时也支持通过语音合成功能将文本转换成逼真的语音等提升用户体验。适用场景如语音客服质检、会议记录、语音短 - [SDK(新版)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0006.md): 推荐使用新版SDK语音交互服务SDK,该SDK基于统一规范开发,支持Java/Python/C++/.NET/Go/NodeJs/PHP,使用方法可参考API Explorer。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能,但该SDK暂不支持通过websocket的方法调用的API。如需使用websoc - [SDK(websocket)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0004.md): 鉴于新版SDK未提供 WebSocket 相关功能支持,若您的业务场景中需要使用 WebSocket 方法,建议选择本页提供的 SDK(WebSocket 版)以满足需求。语音交互SDK软件包获取请参见表 下载SDK包。示例音频参见示例音频。当您使用过旧版本的Java SDK时,需要注意旧版本的SDK依赖的jar包与新版本SDK的jar包 - [AK/SK认证](https://support.huaweicloud.com/sdkreference-sis/sis_05_0003.md): 使用服务API需要进行认证,目前SDK仅支持AK/SK认证方式。使用AK/SK方式,需要用户提供AK和SK。注册并登录华为云管理控制台。在控制台中,鼠标移动至右上角的用户名处,在下拉列表中单击“我的凭证”。单击“访问密钥”页签,在页签中,单击“新增访问密钥”。依据界面操作提示,获取并下载认证账号的AK/SK,请妥善保管AK/SK信息。 - [配置Java环境](https://support.huaweicloud.com/sdkreference-sis/sis_05_0041.md): 在使用语音交互SDK时,需要准备的环境请参见表 开发环境。目前Java SDK不支持在android中使用。开发环境准备项说明操作系统Windows系统,推荐Windows 7及以上版本。JDKJava开发环境的基本配置。版本要求:强烈推荐使用1.8版本。Eclipse在Eclipse官网下载对应平台的Eclipse版本,比如:eclip - [配置Python环境](https://support.huaweicloud.com/sdkreference-sis/sis_05_0056.md): 确保已安装Python3,目前Python SDK仅支持Python3。确保已安装setuptools、requests、websocket-client。下载SDK,通过pip-list命令查看安装包。若未安装,则执行以下命令:pip install setuptools pip install requests pip install - [配置Android 环境](https://support.huaweicloud.com/sdkreference-sis/sis_05_0090.md): 配置环境。在使用语音交互SDK时,需要提前配置好android系统的开发环境,如表1所示。配置环境准备项准备项说明JDKJava开发环境的基础配置。版本要求:推荐使用1.8版本。Gradle在Gradle官网上下载好之后,配置环境变量即可。推荐使用Gradle7.x 版本。AndroidSDK在AndroidSDK官网上下载好之后,配好基 - [配置CPP环境(Windows)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0082.md): 当前Windows 版本 CPP SDK基于visual studio 运行,确保已安装visual studio 2017。依赖curl、openssl、boost、websocketpp软件,相关安装包已打包至SDK中,使用方法详见SDK的使用说明”。 - [配置CPP环境(Linux)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0091.md): c++版本需要在11及以上cmake版本需要在3.14及以上gcc-c++ 版本需要在5.4.0及以上Linux版本CPP SDK依赖g++,cmake,此三项需要提前在机器安装,才能完成sdk编译和运行.本SDK所依赖的三方库包含- openssl- jsoncpp- websocketpp- glog- gflags- boost依赖 - [一句话识别Http接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0044.md): 确保已按照配置Java环境配置完毕。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。请参考SDK(websocket)获取最新版本SDK包。初始化AsrCustomizationClient,其参数包括AuthInfo和SisConfig。请求类为AsrCustomShortRequest,详见表3。响应类为As - [一句话识别Websocket接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0071.md): 确保已按照配置Java环境配置完毕。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。该功能为1.70及以上版本SDK新增功能,使用前请检查并更新SDK版本。请参考SDK(websocket)获取最新版本SDK包。初始化SasrWebsocketClient,其参数包括AuthInfo、RasrListener、S - [录音文件识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0045.md): 确保已按照配置Java环境配置完毕。确保已存在待识别的音频文件并上传OBS或者有公网可访问服务器上(需保证可使用域名访问),示例音频可参考下载SDK压缩包文件。如果音频存放在OBS上,确保服务已授权访问OBS,可参考配置OBS服务。请参考SDK(websocket)获取最新版本SDK包。初始化AsrCustomizationClient, - [实时语音识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0046.md): 确保已按照配置Java环境配置完毕。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。请参考SDK(websocket)获取最新版本SDK包。初始化RasrClient,其参数包括AuthInfo、RasrListener、SisConfig。RasrListener需要用户自定义实现监听逻辑,请参见表1和表2。请 - [语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0048.md): 确保已按照配置Java环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化TtsCustomizationClient,其参数包括AuthInfo和SisConfig。请求类为TtsCustomRequest,详见表3。响应类为TtsCustomResponse,详见表3。调用失败处理方法请参见错误码。如下示例仅供 - [热词管理](https://support.huaweicloud.com/sdkreference-sis/sis_05_0062.md): 确保已按照配置Java环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化HotWordClient,其参数包括AuthInfo和SisConfig。请求类为HotWordRequest,详见表3。创建热词响应参数为String,表示热词表ID。调用失败处理方法请参见错误码。如下示例仅供参考,最新代码请前往SDK( - [实时语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0066.md): 确保已按照配置Java环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化RttsClient,其参数包括AuthInfo和SisConfig。请求类为RttsRequest,详见表3。响应类为RttsDataResponse,详见表5。调用失败处理方法请参见错误码。如下示例仅供参考,最新代码请前往SDK(webs - [录音文件极速版](https://support.huaweicloud.com/sdkreference-sis/sis_05_0067.md): 确保已按照配置Java环境配置完毕。确保已存在待识别的音频文件并上传OBS,示例音频可参考下载SDK压缩包文件,同时确保服务已授权访问OBS,可参考配置OBS服务。请参考SDK(websocket)获取最新版本SDK包。初始化FlashLasrClient,其参数包括AuthInfo和SisConfig。请求类为FlashLasrRequ - [声音注册查询](https://support.huaweicloud.com/sdkreference-sis/sis_05_0099.md): 确保已按照配置Java环境配置配置完毕。请参考SDK(websocket)获取最新版本SDK包。仅上海一局点支持该接口。初始化vcsClient,详见表1。请求类型registerQueryRequest,详见表2。请求类型registerQueryRequest,详见表4。Java SDK响应结果为Json格式,正确响应详见表5,错误响 - [声音复刻接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0100.md): 确保已按照配置Java环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。使用预置音色或注册的声音合成语音。仅上海一局点支持该接口。初始化vcsClient详见表1。请求类型为vcsRequest,详见表2。Java SDK响应结果为Json格式,正确响应详见表5,错误响应详见表7。说明:“endpoint”即调用API - [声音复刻流式接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0101.md): 确保已按照配置Java环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。使用预置音色或注册的声音合成语音。仅上海一局点支持该接口。初始化VcsClient详见表1。请求类型为VcsRequest,详见表2。响应参数分为正确响应,详见表5,和错误响应,详见表6。声音复刻引擎收到合成请求后,会向客户端发送合成开始响应,表示 - [一句话识别Http接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0051.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。请参考SDK(websocket)获取最新版本SDK包。初始化AsrCustomizationClient详见表 AsrCustomizationClient初始化参数。请求类为Asr - [一句话识别Websocket接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0068.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。该功能为1.70及以上版本SDK新增功能,使用前请检查并更新SDK版本。请参考SDK(websocket)获取最新版本SDK包。初始化SasrWebsocketClient详见表 Sa - [录音文件识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0052.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。确保已存在待识别的音频文件并上传OBS或者有公网可访问服务器上(需保证可使用域名访问),示例音频可参考下载SDK压缩包文件。如果音频存放在OBS上,确保服务已授权访问OBS,可参考配置OBS服务。请参考SDK(websocket)获取最新版本SDK包。初始化 - [实时语音识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0053.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。请参考SDK(websocket)获取最新版本SDK包。初始化RasrClient详见表 RasrClient初始化参数。请求类为RasrRequest,详见表3。Python SDK - [语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0055.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。请参考SDK(websocket)获取最新版本SDK包。初始化TtsCustomizationClient详见表 TtsCustomizationClient初始化参数。请求类为TtsCustomRequest,详见表3。Python SDK响应结果为Jso - [热词管理](https://support.huaweicloud.com/sdkreference-sis/sis_05_0065.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。请参考SDK(websocket)获取最新版本SDK包。初始化HotWordClient,详见表 HotWordClient初始化参数。请求类为HotWordRequest,详见表3。创建热词响应参数为Json格式,详见表4。调用失败处理方法请参见错误码。如 - [实时语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0069.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。请参考SDK(websocket)获取最新版本SDK包。初始化RttsClient详见表 RttsClient初始化参数。请求类为RttsRequest,详见表3。Python SDK响应结果为byte数组,保存合成音频数据。详见代码示例。调用失败处理方法请 - [录音文件极速版](https://support.huaweicloud.com/sdkreference-sis/sis_05_0070.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。确保已存在待识别的音频文件。如果需要请在下载的SDK压缩包中获取示例音频。请参考SDK(websocket)获取最新版本SDK包。初始化FlashLasrClient详见表 FlashLasrClient初始化参数。请求类为FlashLasrRequest, - [声音注册查询](https://support.huaweicloud.com/sdkreference-sis/sis_05_0102.md): 确保已按照配置Python环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。仅上海一局点支持该接口。初始化vcs_client,详见表1。请求类型为register_query_request,详见表2。请求类型register_query_request,详见表4。Python SDK响应结果为Json格式,正确响应 - [声音复刻接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0103.md): 确保已按照配置Python环境配置完毕。请参考SDK(websocket)获取最新版本SDK包。使用预置音色或注册的声音合成语音。仅上海一局点支持该接口。初始化vcs_client,详见表1。请求类型为vcs_request,详见表2。Python SDK响应结果为Json格式,正确响应详见表5,错误响应详见表7。说明:“endpoint - [声音复刻流式接口](https://support.huaweicloud.com/sdkreference-sis/sis_05_0104.md): 确保已按照配置Python环境配置完毕,Python SDK仅支持Python3。请参考SDK(websocket)获取最新版本SDK包。使用预置音色或注册的声音合成语音。仅上海一局点支持该接口。初始化vcs_client详解表1。请求类型为vcs_request,详见表2。响应参数分为正确响应,详见表5,和错误响应,详见表6。声音复刻引 - [一句话识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0096.md): 确保已经按照配置好iOS开发环境。已经保存好1分钟内音频文件,建议使用16k16bit进行录音并保存为wav格式。请参考SDK(websocket)获取最新版本SDK包。初始化SASRClient,参数为AuthInfo,详见表1。请求类为SASRConfig和语音数据data,详见表2。响应类为SASRResponse,详见表4。调用失 - [实时语音识别连续模式](https://support.huaweicloud.com/sdkreference-sis/sis_05_0097.md): 确保已经按照配置好iOS开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化RASRClient,参数为AuthInfo和RASRConfig。表2RASRConfig结果响应类为RASRResponse,详见表2。调用失败处理方法请参见错误码。如下示例仅供参考,最新代码请前往SDK(websocket)章节获取并运行 - [一句话识别(http版)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0085.md): 确保已经按照配置好Android开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化SisClient,详细信息如下。配置客户端连接参数。默认配置// 使用默认配置 HttpConfig config = HttpConfig.getDefaultHttpConfig();网络代理(可选)// 根据需要配置网络代理,网 - [一句话识别(websocket版)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0086.md): 确保已经按照配置好Android开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化SasrWsClient,其中参数包含AuthInfo,SisHttpConfig,SasrWsResponseListener,SasrWsConnProcessListener。其中AuthInfo和SisHttpConfig的参数 - [实时语音识别连续模式](https://support.huaweicloud.com/sdkreference-sis/sis_05_0087.md): 确保已经按照配置好Android开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化RasrClient,其中参数包含AuthInfo,SisHttpCnfig,RasrResponseListener,RasrConnProcessListener请求类为RasrRequest,其中参数详见下表如下示例仅供参考,最新 - [语音合成(http版)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0088.md): 确保已经按照配置好Android开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化SisClient,详细信息如下。配置客户端连接参数。默认配置// 使用默认配置 HttpConfig config = HttpConfig.getDefaultHttpConfig();网络代理(可选)// 根据需要配置网络代理,网 - [语音合成(webSocket版)](https://support.huaweicloud.com/sdkreference-sis/sis_05_0089.md): 确保已经按照配置好Android开发环境。请参考SDK(websocket)获取最新版本SDK包。初始化RttsClient,其中参数包含AuthInfo和SisHttpConfig和RttsResponseListener。其中AuthInfo和SisHttpConfig的参数如表1所示。其中RttsResponseListener是用 - [使用实时语音识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0081.md): 该Windows版本SDK不再演进,请移步Linux版本,请参考CPP SDK(Linux)。确保已按照配置CPP环境(Windows)配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化RasrClient,其参数包括AuthInfo。请求类为RasrRequest,详见表 RasrRequest。通过set方法可以 - [使用实时语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0083.md): 该Windows版本SDK不再演进,请移步Linux版本,请参考CPP SDK(Linux)。确保已按照配置CPP环境(Windows)配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化RttsClient,其参数包括AuthInfo请求类为RttsRequest,详见表 RttsRequest。通过set方法可以设 - [使用实时语音识别](https://support.huaweicloud.com/sdkreference-sis/sis_05_0093.md): 确保已按照配置CPP环境(Linux)配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化RasrClient,其参数包括AuthInfo请求类为RasrRequest,详见表 RasrRequest。通过set方法可以设置具体参数,详见表 RasrRequest设置参数如下示例仅供参考,最新代码请前往SDK(webs - [使用实时语音合成](https://support.huaweicloud.com/sdkreference-sis/sis_05_0098.md): 确保已按照配置CPP环境(Linux)配置完毕。请参考SDK(websocket)获取最新版本SDK包。初始化RttsClient,其参数包括AuthInfo请求类为RttsRequest,详见表 RttsRequest。通过set方法可以设置具体参数,详见表 RttsRequest设置参数如下示例仅供参考,最新代码请前往SDK(webs - [示例音频](https://support.huaweicloud.com/sdkreference-sis/sis_05_0039.md): 测试音频如表 示例音频所示,音频文件标题表示采样率和位宽。如8k16bit.pcm表示音频采样率为8k,位宽为16bit。示例音频音频格式下载链接mp3https://sis-sample-audio.obs.cn-north-1.myhuaweicloud.com/16k16bit.mp3wavhttps://sis-sample-au ## API参考 - [概述](https://support.huaweicloud.com/api-sis/sis_03_0002.md): 欢迎使用语音交互服务(Speech Interaction Service ,简称SIS)。语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API获取语音交互结果。支持用户通过语音识别功能,将口述音频、普通话或者带有一定方言的语音文件识别成可编辑的文本,同时也支持通 - [调用说明](https://support.huaweicloud.com/api-sis/sis_03_0003.md): SIS服务提供了两种接口,包含REST(Representational State Transfer)API,支持您通过HTTPS请求调用,调用方法请参见如何调用REST API。也包含WebSocket接口,支持WebSocket协议,调用方法请参见如何调用WebSocket API。调用所需示例音频参见示例音频。调用接口的时候,无需 - [终端节点](https://support.huaweicloud.com/api-sis/sis_03_0004.md): 终端节点即调用API的请求地址,不同服务不同区域的终端节点不同。目前语音交互服务一句话识别、录音文件识别支持以下地区和终端节点:当前服务仅支持北京和上海区域,后续会陆续上线其他区域。华北-北京四,推荐的区域,支持一句话识别、录音文件识别、实时语音识别、语音合成和热词等接口。华东-上海一,推荐的区域,支持一句话识别、录音文件识别、实时语音识 - [基本概念](https://support.huaweicloud.com/api-sis/sis_03_0130.md): 账号用户注册华为云时的账号,账号对其所拥有的资源及云服务具有完全的访问权限,可以重置用户密码、分配用户权限等。由于账号是付费主体,为了确保账号安全,建议您不要直接使用账号进行日常管理工作,而是创建用户并使用他们进行日常管理工作。用户注册华为云时的账号,账号对其所拥有的资源及云服务具有完全的访问权限,可以重置用户密码、分配用户权限等。由于账 - [API概览](https://support.huaweicloud.com/api-sis/sis_03_0005.md): SIS服务提供了两种接口,包含REST(Representational State Transfer)API,支持您通过HTTPS请求调用,请参见表1。也包含WebSocket接口,支持Websocket协议,请参见表2。 - [构造请求](https://support.huaweicloud.com/api-sis/sis_03_0057.md): 本节介绍REST API请求的组成,并以调用一句话识别接口说明如何调用API。您还可以通过这个视频教程了解如何构造请求调用API:https://bbs.huaweicloud.com/videos/102987 。请求URI由如下部分组成。{URI-scheme} :// {Endpoint} / {resource-path} ? { - [认证鉴权](https://support.huaweicloud.com/api-sis/sis_03_0058.md): 调用接口有如下两种认证方式,您可以选择其中一种进行认证鉴权。Token认证:通过Token认证通用请求。AK/SK认证:通过AK(Access Key ID)/SK(Secret Access Key)加密调用请求。Token的有效期为24小时,需要使用同一个Token鉴权时,可以缓存起来,避免频繁调用。Token在计算机系统中代表令牌( - [返回结果](https://support.huaweicloud.com/api-sis/sis_03_0059.md): 请求发送以后,您会收到响应,包含状态码、响应消息头和消息体。状态码是一组从1xx到5xx的数字代码,状态码表示了请求响应的状态,完整的状态码列表请参见状态码。对于SIS服务接口,如果调用后返回状态码为200,则表示请求成功。对应请求消息头,响应同样也有消息头,如Content-type。SIS服务响应消息头无特殊用途,可用于定位问题使用。 - [如何调用WebSocket API](https://support.huaweicloud.com/api-sis/sis_03_0011.md): 在调用实时语音识别的WebSocket接口之前,您需要完成Token认证,详细操作指导请参见认证鉴权。实时语音识别接口使用WebSocket协议承载,客户端与服务端交流流程如图1所示。分为三个主要步骤:WebSocket握手。基于WebSocket协议进行实时语音识别。关闭WebSocket连接。其中,基于WebSocket协议进行实时语 - [接口说明](https://support.huaweicloud.com/api-sis/sis_03_0024.md): 实时语音识别接口基于WebSocket协议实现。分别提供了流式一句话、实时语音识别连续模式、实时语音识别单句模式三种模式。三种模式的握手请求wss-URI不同,基于WebSocket承载的实时语音识别请求和响应的消息格式相同。开发者可以使用java、python、c++等开发语言支持WebSocket的对应软件包或库接口,与实时语音识别引 - [流式一句话](https://support.huaweicloud.com/api-sis/sis_03_0026.md): 流式一句话模式的语音长度限制为一分钟,适合于对话聊天等识别场景。该接口支持用户将一整段语音分段,以流式输入,最后得到识别结果。实时语音识别引擎在获得分段的输入语音的同时,就可以同步地对这段数据进行特征提取和解码工作,而不用等到所有数据都获得后再开始工作。因此这样就可以在最后一段语音结束后,仅延迟很短的时间(即等待处理最后一段语音数据以及获 - [实时语音识别连续模式](https://support.huaweicloud.com/api-sis/sis_03_0027.md): 连续识别模式的语音总长度限制为五小时,适合于会议、演讲和直播等场景。连续识别模式在流式识别的基础上,结合了语音的端点检测功能。语音数据也是分段输入,但是连续识别模式将会在处理数据之前进行端点检测,如果是语音才会进行实际的解码工作,如果检测到静音,将直接丢弃。如果检测到一段语音的结束点,就会直接将当前这一段的识别结果返回,然后继续检测后面的 - [实时语音识别单句模式](https://support.huaweicloud.com/api-sis/sis_03_0028.md): 单句模式自动检测一句话的结束,因此适合于需要与您的系统进行交互的场景,例如外呼、控制口令等场景。实时语音识别引擎的单句识别模式,和连续识别模式类似,也会进行语音的端点检测,如果检测到静音,将直接丢弃,检测到语音才会馈入核心进行实际的解码工作,如果检测到一段语音的结束点,就会将当前这一段的识别结果返回。和连续识别不同的是,在单句模式下,返回 - [实时语音识别工作流程](https://support.huaweicloud.com/api-sis/sis_03_0085.md): 实时语音识别分为开始识别、发送音频数据、结束识别,断开连接四个阶段。开始阶段需要发送开始指令,包含采样率,音频格式,是否返回中间结果等配置信息。服务端会返回一个开始响应。发送音频阶段客户端会分片发送音频数据,服务会返回识别结果或者其他事件,如音频超时,静音部分过长等。音频发送结束后,客户端会发送结束请求,服务端会返回end响应。实时语音识 - [开始识别](https://support.huaweicloud.com/api-sis/sis_03_0030.md): 当wss握手请求收到成功响应后,客户端到服务端的通信协议会升级为WebSocket协议。通过WebSocket协议,客户端发送开始识别请求,用于配置实时语音识别的配置信息。目前仅支持裸音频格式,特别是PCM编码的WAV格式,不支持其他WAV头或ARM格式的编码。状态码请参见状态码。错误码请参见错误码。 - [发送音频数据](https://support.huaweicloud.com/api-sis/sis_03_0031.md): 在收到“开始识别”的响应之后,可以开始发送音频数据。为了节省流量,音频以二进制数据帧形式(binary message)的方式发送。音频数据将分片发送,即在获得一定量音频数据的同时就可以发送一个binary message,每个分片建议在50ms~1000ms之间,建议在需要实时反馈的情况下100ms,不需要实时反馈的情况下500ms。实 - [结束识别](https://support.huaweicloud.com/api-sis/sis_03_0032.md): 对于识别中的对话,需要在WebSocket上发送结束识别的请求来取消或结束识别。 "结束识别"请求使用文本类型的数据帧(text message)发送,命令和参数以json字符串的形式提供。状态码请参见状态码。错误码请参见错误码。 - [开始识别请求响应](https://support.huaweicloud.com/api-sis/sis_03_0034.md): 由于WebSocket是全双工的,因此响应就是从服务器端发送给客户端的消息,但也并不是所有的请求信息都有一条对应的响应。服务器端收到“开始识别”请求时,会给出如下响应消息,以json字符串形式放置在text message中。状态码请参见状态码。错误码请参见错误码。 - [事件响应](https://support.huaweicloud.com/api-sis/sis_03_0035.md): 服务器端检测到某些事件时,会给出如下响应消息,以json字符串形式放置在text message中。在流式一句话模式下:不会返回VOICE_START、VOICE_END、EXCEEDED_SILCENCE事件。不会返回VOICE_START、VOICE_END、EXCEEDED_SILCENCE事件。在实时语音识别单句模式下:返回VOI - [识别结果响应](https://support.huaweicloud.com/api-sis/sis_03_0036.md): 服务端在收到客户端发送的连续音频数据后, 当服务端识别出结果后会实时向客户端按句推送识别结果响应消息, 以json字符串形式放置在text message中。状态码请参见状态码。错误码请参见错误码。 - [错误响应](https://support.huaweicloud.com/api-sis/sis_03_0037.md): 错误响应,通常是指不影响流程,但当前会话无法再进行下去的错误,包括如下情况:配置串错误,包括存在不识别的配置串,或者配置串值的范围不合法。时序不正确,比如连续发送两次“开始识别”指令。识别过程中发生错误,比如音频解码发生错误。出现错误响应时,如果已经在一个会话中了,会再发送一个“结束识别”的响应,表示识别会话结束。如果会话还没有开始,那么 - [严重错误响应](https://support.huaweicloud.com/api-sis/sis_03_0038.md): 严重错误,通常指流程无法继续的情况。比如当出现客户端分片音频间隔超时(例如20s)。出现严重错误响应时,流程不再继续,服务器端会主动断连。状态码请参见状态码。错误码请参见错误码。 - [结束识别请求响应](https://support.huaweicloud.com/api-sis/sis_03_0039.md): 服务器端收到“结束识别”请求时或语音识别过程中发生错误,服务端会向客户端推送如下响应消息,以json字符串形式放置在text message中。状态码请参见状态码。错误码请参见错误码。 - [http接口 - RecognizeShortAudio](https://support.huaweicloud.com/api-sis/sis_03_0094.md): 一句话识别接口,用于短语音的同步识别。一次性上传1min以内音频,能快速返回识别结果。该接口的使用限制请参见约束与限制,详细使用指导请参见SIS服务使用简介章节。SIS服务控制台提供了一句话识别的在线使用页面,用户无需编程即可使用服务功能。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成 - [websocket接口](https://support.huaweicloud.com/api-sis/sis_03_0095.md): 一句话识别WebSocket接口支持识别1min以内的音频,交互过程如图 客户端和服务端交互流程所示,主要分为开始识别、发送音频数据,结束识别、断开连接四个步骤。WebSocket接口同http接口一致按次计费,只要建立连接成功,发送音频,服务开始识别,则本次调用计费生效。如果用户发送错误end请求或者持续20s未发送音频而产生了报错,该 - [提交录音文件识别任务 - PushTranscriberJobs](https://support.huaweicloud.com/api-sis/sis_03_0092.md): 录音文件识别接口,用于识别长录音文件,支持中文普通话、四川话识别。录音文件放在OBS(对象存储服务)或公网可访问的服务器上。由于录音文件识别通常会需要较长的时间,因此识别是异步的,即接口分为创建识别任务和查询任务状态两个接口。创建识别任务接口创建任务完成后返回job_id参数,然后用户通过调用录音文件识别状态查询接口来获得转写状态和结果。 - [获取录音文件识别结果 - CollectTranscriberJob](https://support.huaweicloud.com/api-sis/sis_03_0093.md): 该接口用于获取录音文件识别结果及识别状态。该接口的使用限制请参见约束与限制,详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能。账号具备所有API的调用权限,如果使用账号下的IAM用户调用当前API,该I - [录音文件识别极速版接口 - RecognizeFlashAsr](https://support.huaweicloud.com/api-sis/sis_03_0090.md): 录音文件识别极速版接口,用于录音文件的同步识别。音频需要上传华为云OBS,提供华为云OBS对象地址,能快速返回识别结果。该接口的使用限制请参见约束与限制,详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能 - [语音合成 - RunTts](https://support.huaweicloud.com/api-sis/sis_03_0111.md): 语音合成,是一种将文本转换成逼真语音的服务。用户通过实时访问和调用API获取语音合成结果,将用户输入的文字合成为音频。通过音色选择、自定义音量、语速,为企业和个人提供个性化的发音服务。该接口的使用限制请参见约束与限制,详细使用指导请参见SIS服务使用简介章节。SIS服务控制台提供了语音合成的在线使用页面,用户无需编程即可使用服务功能。您可 - [SSML标记语言介绍](https://support.huaweicloud.com/api-sis/sis_03_0123.md): 本文为您介绍SSML(Speech Synthesis Markup Language)标记语言的功能、标签使用及示例。SSML 是一种基于 XML 的语音合成标记语言。使用 SSML 可以更加准确、具体地定义合成音频的效果,包括控制断句分词方式、发音、速度、停顿、声调和音量等特征。相比文本输入进行合成,有更好的操作灵活性。华为云语音合成 - [Websocket握手请求](https://support.huaweicloud.com/api-sis/sis_03_0113.md): 本接口提供实时流式语音合成。用户每次建立连接,发送待合成文本,服务端将合成结果响应给用户。一次连接只能发送一次文本,如果有多段文本需要合成,需要多次建立连接。实时语音合成和语音合成均属于语音合成接口,采用完全相同的计费规则,两者价格梯度可互相叠加,可参考价格计算器。从流程图可以看出,实时语音合成只需要发送1次开始请求,会陆续收到开始响应、 - [开始语音合成请求](https://support.huaweicloud.com/api-sis/sis_03_0115.md): 客户端与语音合成引擎建立WebSocket连接后,可以发送开始语音合成请求进行语音合成。如果客户端基于该WebSocket连接发送多次合成请求,需在每次请求重新建立WebSocket连接,一次连接只能处理一次合成请求。状态码请参见状态码。错误码请参见错误码。 - [开始合成响应](https://support.huaweicloud.com/api-sis/sis_03_0118.md): 语音合成引擎收到实时语音合成请求时,首先向客户端发送合成开始响应,表示开始处理语音合成请求。状态码请参见状态码。错误码请参见错误码。 - [音频流数据](https://support.huaweicloud.com/api-sis/sis_03_0124.md): 音频流数据具备分多段返回二进制语音数据流的特性。这一特性在实际应用场景中,比如在一些实时语音交互的系统里,能更好地适配网络传输情况,避免因大数据量传输造成卡顿。若用户未对语音格式进行设置,系统将默认返回pcm格式语音,pcm格式是一种较为基础且常用的无损音频格式,能保证语音质量。 - [时间戳数据](https://support.huaweicloud.com/api-sis/sis_03_0125.md): 实时语音合成服务在生成音频流的同时,可以生成每个汉字/英文单词的时间戳信息。该信息可用于视频字幕和驱动数字人口型。设置请求参数subtitle为"word_level"或"phoneme_level"时,开启时间戳功能。word_levelphoneme_level - [语音合成结束响应](https://support.huaweicloud.com/api-sis/sis_03_0120.md): 当合成引擎处理完合成请求后,会发送合成结束响应。客户端收到该响应后关闭当前WebSocket链接即可。状态码请参见状态码。错误码请参见错误码。 - [语音合成错误响应](https://support.huaweicloud.com/api-sis/sis_03_0121.md): 合成引擎处理合成请求时如果发生错误则返回该响应。状态码请参见状态码。错误码请参见错误码。 - [严重错误响应](https://support.huaweicloud.com/api-sis/sis_03_0122.md): 严重错误,通常指流程无法继续的情况。出现严重错误响应时,流程不再继续,服务器端会主动断连。状态码请参见状态码。错误码请参见错误码。 - [创建热词表 - CreateVocabulary](https://support.huaweicloud.com/api-sis/sis_03_0071.md): 在一句话识别、实时语音识别服务中,如果在您的业务领域有一些特有的词,默认识别效果差的时候可以考虑使用热词管理功能,将这些词添加到词表,改善识别效果。热词可以是姓名、公司名、某个领域的专有名词,如人名“王晓茗”(通常会识别为“王小明”)、运输域的“高栏”等。热词不建议太长,也不要有标点符号或者特殊符号。具体限制参见创建热词表 - Creat - [更新热词表 - UpdateVocabulary](https://support.huaweicloud.com/api-sis/sis_03_0072.md): 更新一个热词表,更新成功返回id。详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能。账号具备所有API的调用权限,如果使用账号下的IAM用户调用当前API,该IAM用户需具备调用API所需的权限,具体权 - [查询热词表信息 - ShowVocabulary](https://support.huaweicloud.com/api-sis/sis_03_0073.md): 通过热词表id查询热词表的信息和内容。详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能。账号具备所有API的调用权限,如果使用账号下的IAM用户调用当前API,该IAM用户需具备调用API所需的权限,具 - [删除热词表 - DeleteVocabulary](https://support.huaweicloud.com/api-sis/sis_03_0074.md): 通过热词表id删除热词表。详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能。账号具备所有API的调用权限,如果使用账号下的IAM用户调用当前API,该IAM用户需具备调用API所需的权限,具体权限要求请 - [查询热词表列表 - ShowVocabularies](https://support.huaweicloud.com/api-sis/sis_03_0075.md): 查询用户所有热词表列表。详细使用指导请参见SIS服务使用简介章节。您可以在API Explorer中调试该接口,支持自动认证鉴权。API Explorer可以自动生成SDK代码示例,并提供SDK代码示例调试功能。账号具备所有API的调用权限,如果使用账号下的IAM用户调用当前API,该IAM用户需具备调用API所需的权限,具体权限要求请参 - [注册接口](https://support.huaweicloud.com/api-sis/sis_03_0154.md): 用户上传一段录音,并指定voice_name,在系统中注册声音。一个用户最多注册1000个声音。POST /v1/{project_id}/vcs/voices状态码: 200状态码: 400endpoint即调用API的请求地址,不同服务不同区域的endpoint不同,具体请参见终端节点,当前支持上海一。调用声音注册API,将声音注册到 - [查询接口](https://support.huaweicloud.com/api-sis/sis_03_0155.md): 查询已注册的声音列表。GET /v1/{project_id}/vcs/voices状态码: 200状态码: 400endpoint即调用API的请求地址,不同服务不同区域的endpoint不同,具体请参见终端节点,当前支持上海一。调用查询API,查询已注册的声音列表GET https://{endpoint}/v1/{project_i - [合成接口](https://support.huaweicloud.com/api-sis/sis_03_0156.md): 使用预置音色或注册的声音合成语音。POST /v1/{project_id}/vcs/voices/clone状态码: 200状态码: 400endpoint即调用API的请求地址,不同服务不同区域的endpoint不同,具体请参见终端节点,当前支持上海一。调用合成API,将文本合成为语音POST https://{endpoint}/v - [Websocket握手请求](https://support.huaweicloud.com/api-sis/sis_03_0158.md): 本接口提供实时流式合成。用户建立连接、发送开始消息、发送合成文本消息、发送结束消息、断开连接。其中合成文本消息支持多次发送,可用于大模型输出实时播报等场景。同一个会话中,单次合成不超过300字符,总计不超过10万字符,其中汉字、英文字母、标点或空格均算作字符。服务侧收到流式合成文本后缓存,并按照句子分割后合成。文本合成依赖句子的完整性,确 - [开始指令](https://support.huaweicloud.com/api-sis/sis_03_0172.md): 客户端与语音合成引擎建立WebSocket连接后,首先需要发送配置信息,其后合成的文本都是按照此配置执行,如果不发送开始指令或者多次发送开始指令,都会触发错误响应。流式语音合成支持“ONLY”和“MULTI”两种模式。“ONLY”模式下,用户发送一次文本,服务端流式返回语音数据;“MULTI”模式下,支持用户多次发送文本,服务端流式返回语 - [合成指令](https://support.huaweicloud.com/api-sis/sis_03_0161.md): 在MULTI模式下,开始指令完成后,发送待合成的文本,支持多次发送文本,单次发送的文本长度不超过300字符,总计不超过10万字符,其中1个汉字、1个英文字母、1个标点或1个空格均算作1个字符。ONLY模式无法发送该指令。 - [结束指令](https://support.huaweicloud.com/api-sis/sis_03_0162.md): 在MULTI模式下,客户端所有待合成的文本发送完成后,需要发送结束指令,等待接收完所有的音频,并收到结束响应后,客户端即可与服务端断开连接。 - [开始合成响应](https://support.huaweicloud.com/api-sis/sis_03_0164.md): 声音复刻引擎收到合成请求后,会向客户端发送合成开始响应,表示开始处理声音复刻请求。 - [合成结果响应](https://support.huaweicloud.com/api-sis/sis_03_0165.md): 合成结果分多段返回二进制pcm格式或mp3的语音数据流,用户可以根据需要保存成音频文件。若合成过程中发生错误,返回错误编码和错误信息,方便用户进行问题定位。 - [合成结束响应](https://support.huaweicloud.com/api-sis/sis_03_0166.md): 当合成引擎处理完合成请求后,会发送合成结束响应。客户端收到该响应后关闭当前WebSocket链接即可。 - [合成错误响应](https://support.huaweicloud.com/api-sis/sis_03_0167.md): 合成引擎处理合成请求时如果发生错误则返回该响应。同时连接状态回到初始化状态,放弃待合成的文本,将已合成的文本计费。另外,此连接仍然可以使用,需要重新执行开始指令。 - [严重错误响应](https://support.huaweicloud.com/api-sis/sis_03_0168.md): 严重错误,通常指流程无法继续的情况。出现严重错误响应时,流程不再继续,服务器端会主动断连。 - [事件响应](https://support.huaweicloud.com/api-sis/sis_03_0169.md): 合成引擎处理合成请求时,发送无效的请求时响应,为用户提示,同时舍弃此次请求,但不会对当前的连接和流程产生影响。表1 响应参数表2事件类型示例 - [录音指南](https://support.huaweicloud.com/api-sis/sis_03_0170.md): 避免空旷的环境,在安静且密闭的小房间中录制语音,录制环境以录音棚为最高规格,其次是有吸音棉的小型房间,最后是卧室(有被褥)、书房(有书架,书籍)、小型办公室等(主要目的:吸音,避免回响,避免声音直接接触平滑的墙面)注意环境密闭,关掉产生噪音的设备(例如:空调,风扇,电子设备风扇声等),避免人员走动,避免碰撞摩擦导致声音,注音外界引入噪声。 - [示例音频](https://support.huaweicloud.com/api-sis/sis_03_0084.md): 测试音频如表 示例音频所示,音频文件标题表示采样率和位宽。如8k16bit.pcm表示音频采样率为8k,位宽为16bit。示例音频音频格式下载链接mp3https://sis-sample-audio.obs.cn-north-1.myhuaweicloud.com/16k16bit.mp3wavhttps://sis-sample-au - [获取项目ID](https://support.huaweicloud.com/api-sis/sis_03_0008.md): 登录管理控制台。在控制台中,鼠标移动至右上角的用户名处,在下拉列表中选择我的凭证。我的凭证入口在我的凭证页面,可以查看用户名、账号名,在项目列表中查看项目。查看项目ID多项目时,展开“所属区域”,从“项目ID”列获取子项目ID。获取项目ID的接口为“GET https://{Endpoint}/v3/projects”,其中{Endpoi - [获取账号ID](https://support.huaweicloud.com/api-sis/sis_03_0050.md): 在调用接口的时候,部分URL中需要填入账号ID(domain-id),所以需要先在管理控制台上获取到账号ID。账号ID获取步骤如下:注册并登录管理控制台。在控制台中,鼠标移动至右上角的用户名处,在下拉列表中选择我的凭证。我的凭证入口在“我的凭证”页面的项目列表中查看账号ID。查看账号ID - [获取AK/SK](https://support.huaweicloud.com/api-sis/sis_03_0051.md): 如果已生成过AK/SK,则可跳过此步骤,找到原来已下载的AK/SK文件,文件名一般为:credentials.csv。如下图所示,文件包含了租户名(User Name),AK(Access Key Id),SK(Secret Access Key)。AK/SK生成步骤:登录管理控制台。单击右上角的用户名,在下拉列表中单击“我的凭证”。单击 - [公共请求参数](https://support.huaweicloud.com/api-sis/sis_03_0042.md): 公共请求参数如表 公共请求参数所示。其它header属性,请遵照https协议。调用业务接口时,在请求消息头中需增加Content-Type的消息体。 - [公共响应参数](https://support.huaweicloud.com/api-sis/sis_03_0043.md): 公共响应参数如表 公共响应参数所示。 - [状态码](https://support.huaweicloud.com/api-sis/sis_03_0044.md): 华为云帮助中心,为用户提供产品简介、价格说明、购买指南、用户指南、API参考、最佳实践、常见问题、视频帮助等技术文档,帮助您快速上手使用华为云服务。 - [错误码](https://support.huaweicloud.com/api-sis/sis_03_0045.md): 调用接口出错后,将不会返回结果数据。调用方可根据每个接口对应的错误码来定位错误原因。当调用出错时,HTTPS请求返回一个 4xx 或 5xx 的 HTTPS状态码。返回的消息体中是具体的错误代码及错误信息。在调用方找不到错误原因时,可以联系华为云客服,并提供错误码,以便尽快帮您解决问题。当接口调用出错时,会返回错误码及错误信息说明,错误响 - [配置OBS访问权限](https://support.huaweicloud.com/api-sis/sis_03_0047.md): OBS全称Object Storage Service(对象存储服务),提供海量、安全、高可靠、低成本的数据存储能力,可供用户存储任意类型和大小的数据。EI企业智能服务对于图片、语音等多媒体文件支持直接使用华为云OBS服务的数据处理方式,以减少服务使用成本,降低服务的响应时长,提升服务使用的体验。语音交互服务优先推荐使用同一region下 ## 常见问题 - [什么是语音交互服务](https://support.huaweicloud.com/sis_faq/sis_04_0002.md): 语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API(Application Programming Interface,应用程序编程接口)获取语音交互结果。例如用户通过语音识别功能,将口述音频、普通话或者带有一定方言的语音文件识别成可编辑的文本,同时也支持通过语 - [支持哪些语言](https://support.huaweicloud.com/sis_faq/sis_04_0029.md): 录音文件识别、语音合成支持中文普通话。一句话识别和实时语音识别支持中文普通话,带方言口音的普通话和方言(四川话、粤语和上海话)。 - [语音合成后输出的音频格式是什么](https://support.huaweicloud.com/sis_faq/sis_04_0061.md): 语音合成后返回一组Base64编码格式的语音数据,用户需要用编程语言或者sdk将返回的Base64编码格式的数据解码成byte数组,再保存为wav格式的音频。语音合成(Text To Speech ,TTS服务)服务的音频格式则根据接口中audio_format参数设置的语音格式为准。若audio_format的值设置为wav,则解码后输 - [语音合成后能否返回播放时长](https://support.huaweicloud.com/sis_faq/sis_04_0062.md): 不能,当前语音合成无此参数。若需要知道语音时长,可以将返回语音数据解码转换成音频格式,播放后查看。 - [是否支持aac格式的语音文件转文字](https://support.huaweicloud.com/sis_faq/sis_04_0064.md): 一句话识别和录音文件识别以及实时语音识别均可实现语音转文字,一句话识别支持aac格式,录音文件识别和实时语音识别不支持aac格式。 - [如何查看当前接口是否免费调用](https://support.huaweicloud.com/sis_faq/sis_04_0065.md): 一句话识别、语音合成按调用次数计费;实时语音识别、录音文件识别按音频时长计费;录音文件识别极速版按照“音频时长×需要识别的音频声道数“计费,时长计算精确到秒。按音频时长计费的,累加每次调用的音频时长。按调用次数计费的,返回失败的调用不计入次数。调用热词接口,不单独计费。按需计费按需计费是指按照API调用次数阶梯价格计费,计费价格参见语音交 - [什么是语音交互服务](https://support.huaweicloud.com/sis_faq/sis_04_0002.md): 语音交互服务(Speech Interaction Service,简称SIS)是一种人机交互方式,用户通过实时访问和调用API(Application Programming Interface,应用程序编程接口)获取语音交互结果。例如用户通过语音识别功能,将口述音频、普通话或者带有一定方言的语音文件识别成可编辑的文本,同时也支持通过语 - [支持哪些语言](https://support.huaweicloud.com/sis_faq/sis_04_0029.md): 录音文件识别、语音合成支持中文普通话。一句话识别和实时语音识别支持中文普通话,带方言口音的普通话和方言(四川话、粤语和上海话)。 - [语音合成后输出的音频格式是什么](https://support.huaweicloud.com/sis_faq/sis_04_0061.md): 语音合成后返回一组Base64编码格式的语音数据,用户需要用编程语言或者sdk将返回的Base64编码格式的数据解码成byte数组,再保存为wav格式的音频。语音合成(Text To Speech ,TTS服务)服务的音频格式则根据接口中audio_format参数设置的语音格式为准。若audio_format的值设置为wav,则解码后输 - [语音合成后能否返回播放时长](https://support.huaweicloud.com/sis_faq/sis_04_0062.md): 不能,当前语音合成无此参数。若需要知道语音时长,可以将返回语音数据解码转换成音频格式,播放后查看。 - [是否支持aac格式的语音文件转文字](https://support.huaweicloud.com/sis_faq/sis_04_0064.md): 一句话识别和录音文件识别以及实时语音识别均可实现语音转文字,一句话识别支持aac格式,录音文件识别和实时语音识别不支持aac格式。 - [如何查看当前接口是否免费调用](https://support.huaweicloud.com/sis_faq/sis_04_0065.md): 一句话识别、语音合成按调用次数计费;实时语音识别、录音文件识别按音频时长计费;录音文件识别极速版按照“音频时长×需要识别的音频声道数“计费,时长计算精确到秒。按音频时长计费的,累加每次调用的音频时长。按调用次数计费的,返回失败的调用不计入次数。调用热词接口,不单独计费。按需计费按需计费是指按照API调用次数阶梯价格计费,计费价格参见语音交 - [套餐包购买后是否支持退款](https://support.huaweicloud.com/sis_faq/sis_04_0043.md): 套餐包购买后不支持退款。 - [服务当前处于商用还是免费阶段](https://support.huaweicloud.com/sis_faq/sis_04_0058.md): 当前语音交互服务在中国区已全部商用,使用该服务需要收费。详细的接口费用说明请参见计费说明。 - [如何收费](https://support.huaweicloud.com/sis_faq/sis_04_0059.md): 语音服务收费是按照调用接口的次数或者时长来计算费用,详细收费明细请参见价格计算器。支持两种计费方式:按需计费,默认计费方式为“按需计费”。折扣套餐包方式,是用户可以购买套餐包,扣费时调用次数会先在套餐包内进行抵扣,抵扣完后的剩余调用量默认转回按需计费方式。 - [如何续费](https://support.huaweicloud.com/sis_faq/sis_04_0091.md): 登录SIS服务控制台。单击左侧导航栏“套餐包 > 续费管理”,进入“费用中心 > 订单管理 > 续费管理”页面。查看资源的到期时间并进行续费操作。续费项列会展示全部云服务,请按照订购的资源包名称进行搜索。续费管理续费项列会展示全部云服务,请按照订购的资源包名称进行搜索。续费管理 - [查看套餐用量明细、账单明细](https://support.huaweicloud.com/sis_faq/sis_04_0060.md): 登录SIS服务控制台。单击左侧导航栏“套餐包 > 套餐包管理”,进入“费用中心 > 资源包”页面查看套餐包的用量,在“费用中心 > 账单管理”中查看账单明细。资源包列会展示全部云服务,请按照订购的资源包名称进行搜索。资源包列表资源包列会展示全部云服务,请按照订购的资源包名称进行搜索。资源包列表 - [账号中存在语音合成服务的套餐,但是为什么却收到了欠费的信息](https://support.huaweicloud.com/sis_faq/sis_04_0080.md): 账号中存在语音合成服务的套餐,但是为什么却收到了欠费的信息?如果是同一个区域的服务,存在套餐会先从套餐计费,超出套餐的部分才会按照按需计费。请确认上述套餐和欠费服务否属于不同服务或者不同区域的。 - [欠费后充值账户,为什么调用SIS API仍返回'resource type is RESTRICTED'](https://support.huaweicloud.com/sis_faq/sis_04_0093.md): 充值后需要等待1min后才能进行调用。如果使用token进行调用api(非ak/sk),需要在充值后重新获取token,再进行调用。 - [欠费后套餐包能否继续使用](https://support.huaweicloud.com/sis_faq/sis_04_0094.md): 1. 若账户欠费前从未调用过API, 例如从未调用过一句话识别,欠费后即会被拦截,即使套餐包有余量未消耗。2. 若账户欠费前已调用API,欠费后可正常调用,扣减套餐包余量。3. 若账户已被华为云账户中心冻结,则无法调用,即使套餐包有余量未消耗。 - [套餐包购买后是否支持退款](https://support.huaweicloud.com/sis_faq/sis_04_0043.md): 套餐包购买后不支持退款。 - [服务当前处于商用还是免费阶段](https://support.huaweicloud.com/sis_faq/sis_04_0058.md): 当前语音交互服务在中国区已全部商用,使用该服务需要收费。详细的接口费用说明请参见计费说明。 - [如何收费](https://support.huaweicloud.com/sis_faq/sis_04_0059.md): 语音服务收费是按照调用接口的次数或者时长来计算费用,详细收费明细请参见价格计算器。支持两种计费方式:按需计费,默认计费方式为“按需计费”。折扣套餐包方式,是用户可以购买套餐包,扣费时调用次数会先在套餐包内进行抵扣,抵扣完后的剩余调用量默认转回按需计费方式。 - [如何续费](https://support.huaweicloud.com/sis_faq/sis_04_0091.md): 登录SIS服务控制台。单击左侧导航栏“套餐包 > 续费管理”,进入“费用中心 > 订单管理 > 续费管理”页面。查看资源的到期时间并进行续费操作。续费项列会展示全部云服务,请按照订购的资源包名称进行搜索。续费管理续费项列会展示全部云服务,请按照订购的资源包名称进行搜索。续费管理 - [查看套餐用量明细、账单明细](https://support.huaweicloud.com/sis_faq/sis_04_0060.md): 登录SIS服务控制台。单击左侧导航栏“套餐包 > 套餐包管理”,进入“费用中心 > 资源包”页面查看套餐包的用量,在“费用中心 > 账单管理”中查看账单明细。资源包列会展示全部云服务,请按照订购的资源包名称进行搜索。资源包列表资源包列会展示全部云服务,请按照订购的资源包名称进行搜索。资源包列表 - [账号中存在语音合成服务的套餐,但是为什么却收到了欠费的信息](https://support.huaweicloud.com/sis_faq/sis_04_0080.md): 账号中存在语音合成服务的套餐,但是为什么却收到了欠费的信息?如果是同一个区域的服务,存在套餐会先从套餐计费,超出套餐的部分才会按照按需计费。请确认上述套餐和欠费服务否属于不同服务或者不同区域的。 - [欠费后充值账户,为什么调用SIS API仍返回'resource type is RESTRICTED'](https://support.huaweicloud.com/sis_faq/sis_04_0093.md): 充值后需要等待1min后才能进行调用。如果使用token进行调用api(非ak/sk),需要在充值后重新获取token,再进行调用。 - [欠费后套餐包能否继续使用](https://support.huaweicloud.com/sis_faq/sis_04_0094.md): 1. 若账户欠费前从未调用过API, 例如从未调用过一句话识别,欠费后即会被拦截,即使套餐包有余量未消耗。2. 若账户欠费前已调用API,欠费后可正常调用,扣减套餐包余量。3. 若账户已被华为云账户中心冻结,则无法调用,即使套餐包有余量未消耗。 - [如何查看接口调用量](https://support.huaweicloud.com/sis_faq/sis_04_0021.md): 登录控制台。选择左侧导航栏中的“总览”。在“服务监控”中查看API总调用量、调用成功量、调用失败量。接口调用量 - [为什么WebSocket一直连接不成功](https://support.huaweicloud.com/sis_faq/sis_04_0014.md): 由于在没连接成功前无法返回服务端任何信息,因此连接不成功需要多方面定位原因。1. 检查网络是否可用,能否连接互联网,检查url输入是否正确。2. 检查Token是否可用,检查Token的方法参考调用语音交互的API显示auth failed3. 检查协议是否支持,目前Websocket使用tls1.2协议,Websocket库使用tls1 - [为什么会出现识别结果非常差的情况](https://support.huaweicloud.com/sis_faq/sis_04_0019.md): 调用语音识别接口,识别结果同真实结果差别很大,或者服务端报音频格式错误。检查音频采样率是否符合。对于裸音频,可采用toolsoft Audio player等工具进行试听,通过设置不同的采样率,播放正常的即为音频正常采样率。对于裸音频,可采用toolsoft Audio player等工具进行试听,通过设置不同的采样率,播放正常的即为音频 - [如何使用Websocket调用实时语音识别](https://support.huaweicloud.com/sis_faq/sis_04_0028.md): 1. 下载Java SDK 或 Python SDK,参考《SDK参考》中获取SDK章节。2. 配置SDK环境,参考《SDK参考》中配置Java环境。3. 使用SDK里的demo进行调用。参考Java SDK和Python SDK。 - [有哪些途径可以使用语音交互的API](https://support.huaweicloud.com/sis_faq/sis_04_0004.md): 共有三种方式可以基于已构建好的请求消息发起请求。cURLcURL是一个命令行工具,用来执行各种URL操作和信息传输。cURL充当的是HTTP客户端,可以发送HTTP请求给服务端,并接收响应消息。cURL适用于接口调试。关于cURL详细信息请参见https://curl.haxx.se/。编码通过编码调用接口,组装请求消息,并发送处理请求消 - [返回状态正常,但识别结果为空](https://support.huaweicloud.com/sis_faq/sis_04_0031.md): 一般由于格式不匹配造成的。请按照以下情况进行排查。1. 请确保音频格式和请求格式参数保持一致,音频采样率和选择property参数中采样率保持一致。2. 请确保音频位宽为16bit,目前仅支持16bit位宽的音频,如果低于该位宽的音频,则无法正常识别。 - [Token消息体中user name,domain name和project name分别指的是什么](https://support.huaweicloud.com/sis_faq/sis_04_0032.md): user name指用户名称,domain name指用户所属的账号名称。如果是账号获取token,账号的user name和domain name相同。如果是IAM用户获取token(账号可以创建多个IAM用户),user name和domain name不相同,user name为实际的用户名称。project name指项目名称,如 - [如何调整并发](https://support.huaweicloud.com/sis_faq/sis_04_0025.md): API接口支持并发调用。具体可咨询商务合作。 - [为什么录音文件识别出现重复转写结果](https://support.huaweicloud.com/sis_faq/sis_04_0024.md): 调用录音文件识别接口,识别的结果出现两条完全一致的结果。由于声道设置的原因,单声道的音频按照双声道处理了。在请求中将参数channel的值修改成MONO或者直接去掉请求参数中的channel项。 - [调用语音交互的API显示auth failed](https://support.huaweicloud.com/sis_faq/sis_04_0012.md): 校验失败服务端通常是使用不正确的Token进行访问,可能产生的原因有多种。检查用户账号是否正常。当用户账号存在未实名认证、未充值或者属于冻结状态。您可登录账号,在用户检查是否实名认证,是否有余额(以上信息在用户Console均可以查到)。当用户账号存在未实名认证、未充值或者属于冻结状态。您可登录账号,在用户检查是否实名认证,是否有余额(以 - [调用语音交互的API超时怎么处理(connect timeout)](https://support.huaweicloud.com/sis_faq/sis_04_0005.md): 超时通常是由于网络不通造成的,需要对网络环境和代码进行具体分析。检查网络是否正常。确保网络正常连接互联网,正常访问华为云官网,成功获取Token等。如果使用代理,需要保证代理可用性。确保网络正常连接互联网,正常访问华为云官网,成功获取Token等。如果使用代理,需要保证代理可用性。检查url是否存在错误。如书写出错,http方法出错(ge - [为什么服务端返回OBS链接不可用(data url is unreachable)](https://support.huaweicloud.com/sis_faq/sis_04_0020.md): 服务后台无法访问用户提供的音频的OBS链接。即无法获取用户需要识别的音频文件。检查用户是否授权服务访问OBS。检查存放音频的OBS的Region和服务的Region是否为同一区域,只有同一区域的OBS才能正常访问。检查音频的OBS URI是否正确。 - [语音合成的base64编码如何使用](https://support.huaweicloud.com/sis_faq/sis_04_0072.md): 用户在使用语音合成获取响应体的base64编码,不了解应该如何进一步使用。1. 建议用户使用Java或Python SDK,可参考SDK简介。2. 使用html网页播放,新建一个html文件,如下填写内容,即可在浏览器播放。