端到端语音语言大模型API 接口描述 百度端到端语音语言大模型基于业内首创的Cross-Attention跨模态语音大模型,具备极速响应、拟人音色,实现真人级别语音对话交互。极致共情、超高双商,支持深度需求理解与复杂任务执行。广泛应用于实时语音交互的情感陪伴、社交娱乐以及知识问答等场景。请点击链接进入 端到端语音大模型 详情。
文本帧:Opcode 0x1 (Text), 实时语音识别api发送的第一个开始参数帧和最后一个结束帧,文本的格式是json 二进制帧:Opcode0x2 (Binary), 实时语音识别api 发送的中间的音频数据帧 接收数据帧: Receiving Data Frame, 类似包的概念,指一次发送的内容 。从服务端到客户端。
步骤3-调用API 在调用API的时候,需要拼接签名字符串,现在鉴权方式是APP鉴权,需要用到AppKey、AppSecret进行签名计算。 将签名后的字符串X-Bce-Signature放入请求的header中,网关会通过对称计算签名来验证请求者的身份。 根据不同的鉴权方式,请求的Header中传入对应计算后的签名,将入参信息按照请求签名说明生成签名字符串,这样才能请求验证通过。
注意需要在API Key信息前加上`Bearer `。
80001(中文语音近场识别模型极速版),1737(英文模型) rate int 是 采样率 [16000] 固定值 role_num int 否 所属发音人 固定值5,pid为8953时由算法自动判断说话人,本参数非必需。
权限说明 调用本文API,需使用API Key鉴权方式。使用API Key鉴权调用API流程,具体调用流程,请查看 认证鉴权 。 请求参数 Headers 参数 除公共头域外,无其它特殊头域 Body 参数 query string 检索query。 最长为1024字符,超过自动截断。 必选 knowledgebase_ids array 指定知识库的id集合。
search 基于搜索关键字进行全文检索, 支持通过标量属性进行过滤 。 权限说明 鉴权认证机制的详细内容请参见 鉴权认证 请求参数 Headers 参数 除公共头域外,无其它特殊头域 URL 参数 version string API版本号,当前取1。 必选 host string {实例IP}:{实例Port} 必选 Body 参数 database string 指定库的名称。
grantRoles 将指定的的一个或多个角色授权给指定的用户,完成授权之后,该用户自动获得这些角色具备的所有权限。 权限说明 鉴权认证机制的详细内容请参见 鉴权认证 请求参数 Headers 参数 除公共头域外,无其它特殊头域 URL 参数 version string API版本号,当前取1。
select 根据指定的一个或多个权限元组来筛选同时满足这些权限要求的角色。若不指定任何权限,则等价于列出所有角色。 权限说明 鉴权认证机制的详细内容请参见 鉴权认证 请求参数 Headers 参数 除公共头域外,无其它特殊头域 URL 参数 version string API版本号,当前取1。
grantPrivileges 将指定的一个或多个权限元组(Privilege Tuple)授权给指定的角色。支持同时授权具体的权限和权限组(Privilege Group)。 权限说明 鉴权认证机制的详细内容请参见 鉴权认证 请求参数 Headers 参数 除公共头域外,无其它特殊头域 URL 参数 version string API版本号,当前取1。