爱豆语音技术指导  内容精选
  • 产品更新动态 - 语音技术

    适用场景: 基于HarmonyOS系统的智能手机、穿戴设备、车机系统等终端,支持语音助手、语音控制等功能 接入文档: 语音合成 Harmony OS SDK 、 语音识别 Harmony OS SDK 2025-06-05 大模型声音复刻服务上新 产品分类: 大模型语音 功能描述: 基于大模型zero-shot技术,随时随地录制数秒音频,即可极速复刻音色用于语音合成。

    查看更多>>

  • 鉴权认证 - 语音技术

    鉴权认证 语音技术主要支持两种鉴权方式:access_token鉴权机制和API Key鉴权机制。二者分别支持的功能范围和适用的用户群体如下: 鉴权机制 支持的功能范围 适用群体 access_token鉴权机制 包括语音技术在内的AI开放能力的所有能力。

    查看更多>>

爱豆语音技术指导  更多内容
  • 语音质检API - 语音技术

    语音质检API 接口描述: 语音质检接口可以通过声道进行说话人区分,或者通过模型(8953)对单声道音频进行说话人区分。并且支持创建质检规则,对符合质检规则的ASR文本进行标记。 准备工作 1、账户创建及appid鉴权信息获取可参考 快速开发指南-准备工作 。 2、access_token鉴权信息获取,可参考 鉴权认证机制 。 可点击下载 python demo 示例代码进行测试。

    查看更多>>

  • 实时语音识别-websocket API - 语音技术

    实时语音识别接口支持在语音自训练平台上训练中文普通话模型 训练后的模型注意必须填写上线模型的模型参数,可在自训练平台的模型调用模块进行查看。

    查看更多>>

  • 简介 - 语音技术

    简介 简介 Hi,您好,欢迎使用百度语音合成服务。 本文档主要针对开发者,描述百度语音合成接口服务的相关技术内容。如果您对文档内容有任何疑问,可以在百度云控制台内 提交工单 联系我们,咨询问题类型请选择 人工智能服务 ; 接口能力 接口名称 接口能力简要描述 语音合成 将计算机自己产生的、或外部输入的文字信息转变为可以听得懂的、流利的口语输出的技术

    查看更多>>

  • 计费概述 - 语音技术

    计费概述 计费简介 语音服务提供一定额度的 免费测试资源 供测试使用,免费测试资源使用完毕可选择按照 预付费 和 后付费 方式进行计费,两种计费方式均可在 控制台 直接开通或购买。当发生接口调用时,系统会按照如下顺序依次抵扣: 免费测试资源 > 预付费资源包 >按量后付费 。 免费测试资源 免费测试资源 是指免费调用次数,供测试使用。免费测试资源使用完毕后可开通付费按次计费。

    查看更多>>

  • 常见问题汇总 - 语音技术

    旧版序列号无法使用新版精品音库资源 若您在2025年11月27日之前购买或申请SN(序列号),请点击下载 往期基础音库资源 及 往期精品音库资源 ,按照技术文档正常下载使用即可。 2. Android播放多段长文本 建议使用sdk内部的队列缓存。

    查看更多>>

  • 错误码汇总 - 语音技术

    合成后端未知错误 -11 等待用户语音超时 -12 语音解码器错误 -13 与后端连接被关闭 -14 等待后端结果超时 -15 连接百度服务鉴权失败 -16 连接百度服务失败 -17 语音识别失败 -20 语音合成文本为空 -21 语音合成文本过长 -22 从服务器拉取合成文本失败 -23 语音合成文本格式错误 -24 语音合成传递参数错误 问题反馈 如有使用问题,可通过提交 工单 进行反馈。

    查看更多>>

  • 语音技术

    查看更多>>

  • EasyDL语音自训练平台 - 语音技术

    EasyDL语音自训练平台 简介 HI,您好,欢迎使用 EasyDL语音识别 。 原语音自训练平台即日已结束公测正式上线,品牌升级更名为“EasyDL语音识别”,平台和语音识别通用接口全面打通,语音技术下任一接口开通付费即可免费训练语音识别模型,无需额外费用。

    查看更多>>