统及版本 使用文件流演示接口基本识别功能 耗时计算 模拟实时音频流 断网补发数据 Java 任意,支持Java 8或以上 √ √ √ Android Android Api Level 15 或以上 √ √ √ Python 任意,支持Python3 √ C++ Linux ,支持C
百度为了更好地兼容,支持1次及2次urlencode, 其中2次urlencode可以覆盖全部的特殊字符。SDK内部加了1次urlencode,因而推荐传递tex 参数时再做1次urlencode编码。 测试用例:“1+1=2”。 依靠SDK内的1次urlencode时,“+”可能会没有合成。
度逍遥>) 4(可爱童声C;度丫丫>) 在线精品:106(情感男声C;度博文>) 110 (活泼童声C;度小童>) 111 (可爱童声C;度小萌>) 103(可爱童声C;度米朵>) 5(情感女声C;度小娇>) 5118(甜美女声C;度小鹿>) 5003(磁性男声C;度逍遥(精品)>) 更多在线发音人可点击 音色列表 BDS_SYNTHESIZER_PARAM_USER_AGENT
百度为了更好地兼容,支持1次及2次urlencode, 其中2次urlencode可以覆盖全部的特殊字符。SDK内部加了1次urlencode,因而推荐传递tex 参数时再做1次urlencode编码。 测试用例:“1+1=2”。 依靠SDK内的1次urlencode时,“+”可能会没有合成。 返回样例 : 返回TtsResponse类。
SDK 已支持多种语言,包括 Java、 Python、PHP、C++、C#、NodeJS、Android ADK、iOS SDK 等。您可点击下载对应的 SDK 语音合成 、 语音识别 。 更多参考 语音识别API文档 语音合成API文档 如何获取 API Key 和 Secret Key
离线可以支持识别任意词识别(听写识别)吗? 我们推荐使用在线识别,离线识别仅支持命令词识别。如果您有强烈、明确的离线任意词识别的场景,请详细描述您的需求,在官网底部点击“商务合作”,我们会有专人联系。 9. 觉得识别不准确怎么办? 请对类似的语音做多次尝试,并整理录音文件、识别的日志(带sn)、期望的识别结果以及实际的识别结果文件,通过百度云工单提交给我们。 10.
示例一 : 给10个人进行声音复刻,每人复刻一次,累计复刻10次,计费为10次。 示例二 : 给1个人进行声音复刻,同一个人复刻了10次,计费为10次。 在线合成 大模型声音复刻-在线合成按调用字符计费,支持“按字符包预付费”和“按调用字符后付费”两种付费方式。
长文本在线合成 长文本在线合成接口可以将10万字以内文本一次性合成,异步返回音频。支持多种优质音库,将超长文本快速转换成稳定流畅、饱满真实的音频。适用于阅读听书、新闻播报等客户。 流式文本在线合成 基于websocket协议,在用户输入文本的同时就能接近同步返回合成音频数据,实现“边合成边播放”。支持多种优质音库与多种参数,适用于语音助手、在线教育、语音播报等场景。
计费与付费 对于免费测试资源未使用完毕的接口服务,开通付费后,先使用免费测试资源中的调用额度,使用完毕后优先抵扣预付费资源包额度,抵扣完毕才根据调用量进行阶梯计费; 采用按量后付费的计费方式,每小时对您的百度云账户进行扣费;使用预付费资源包计费方式,同样每小时进行抵扣,从已购买的资源包中按照购买 时间顺序由早至晚 ,按照 规格由小至大 依次扣除相应额度; 用户开通付费前需保证账户已完成个人/企业实名认证
通过API Key / Secret Key获取AccessToken 此种身份验证方案使用AK/SK获得AccessToken。 虽然SDK对网络传输的敏感数据进行了二次加密,但由于AK/SK是明文填写在代码中,在移动设备中可能会存在AK/SK被盗取的风险。有安全考虑的开发者可使用第二种授权方案。