文字识别离线SDK 面向无网或弱网环境下,在手机、摄像头、工控机等设备终端上集成文字识别能力,离线识别各类文档、卡证、票据等文本信息,毫秒级快速响应;支持Android、Windows、iOS、 Linux等多种主流平台 优惠 人工智能品类特惠,文字识别产品低至1折!
适用于题目检索等智慧教育场景 办公文档识别 可对办公类文档的版面进行分析,输出图、表、标题、文本、印章、栏、页眉、页脚和脚注等位置和分版块内容的OCR识别结果,支持表格识别,印章识别和单字置信度输出,支持中、英、日、韩、法等 20+ 语言类型,手写、印刷体混排多种场景
园区管理等场景 方案介绍 申请免费试用 软硬一体方案 基于EdgeBoard硬件,内置人体属性识别、检测算法,可离线本地化部署,软硬一体效果佳 立即购买 使用文档 即刻免费体验人体检测与属性识别能力 公有云API最高可享5 QPS,50000次免费测试调用 立即使用 相关推荐 零门槛AI开发自助平台 零基础即可自助训练完成AI开发,涵盖图像、文本、语音、视频等多种场景,最快15分钟完成 人流量统计
公有云API最高可享3W次免费测试资源 立即使用 相关推荐 看图识万物 基于多模态大模型实现万物精准识别,支持针对图像主体内容进行通识性知识问答,整合百度百科及百度搜索,输出高时效性、多维度的答案 零门槛AI开发自助平台 零基础即可自助训练完成AI开发,涵盖图像、文本、语音、视频等多种场景,最快15分钟完成 通用物体和场景识别 可识别超过10万类常见物体和场景,接口返回大类及细分类的名称,并支持获取识别结果对应的百科信息
各项操作流畅,页面交互顺滑,带来极致的交互体验 模块化灵活搭配 语音识别、指令解析、文本后处理(如热词、敏感词、简繁转化)等功能可组件化提供,支持客户按需选择搭配 数据安全管理 端云一体化解决方案,包含算法模型及配置平台等,全部支持专属云、私有化部署,保证数据及系统安全 应用场景 政务指挥大厅 能源行业调度 企业智慧大脑 智能运营指挥大厅 面向政务指挥中心等场景,通过语音数据大屏解决方案助力企业通过集中化的智能
公有云API最高可享3000次免费测试资源 立即使用 相关推荐 看图识万物 基于多模态大模型实现万物精准识别,支持针对图像主体内容进行通识性知识问答,整合百度百科及百度搜索,输出高时效性、多维度的答案 菜品识别 识别超过9千种菜品,支持客户创建属于自己的菜品图库,可准确识别图片中的菜品名称、位置,并获取百科信息 零门槛AI开发自助平台 零基础即可自助训练完成AI开发,涵盖图像、文本、语音、视频等多种场景
AI开发,涵盖图像、文本、语音、视频等多种场景,最快15分钟完成
新建AipSpeech AipSpeech是语音识别与合成的Java客户端,为使用语音合成的开发人员提供了一系列的交互方法。
可部署至「本地服务器」或「专有云服务器」的文字识别服务,支持通用场景、卡证、票据、iOCR等各类模型 了解详情 人脸离线识别SDK 提供离线设备端的人脸检测与采集、活体检测、人脸对比与识别等功能,可在无网络环境下本地运行处理 了解详情 离线语音合成SDK 支持在无网或弱网环境下进行语音播报,为手机应用或AI玩具、机器人等智能硬件终端提供稳定一致、流畅自然的合成体验 了解详情 即刻体验 申请可获免费试用权限
长文本在线合成API 接口描述 长文本在线合成接口可以将10万字以内文本一次性合成,异步返回音频。支持多种优质音库,将超长文本快速转换成稳定流畅、饱满真实的音频。适用于阅读听书、新闻播报等客户。 步骤 : 1、根据文本内容、音频格式、音库等参数创建语音合成任务,获取task_id参数。 2、根据task_id的数组批量查询语音合成任务结果。