20+种语言 手写文字识别 多场景、高精度的手写文字识别服务,支持中、英、日、韩、法等 20+ 语言类型,识别准确率可达 90% 以上 表格文字识别 支持识别图片/PDF格式文档中的表格内容,返回各表格的表头表尾内容、单元格文字内容及其行列位置信息,全面覆盖各类表格样 即刻免费体验文档图像处理能力 企业实名即可获得100次免费测试资源 立即使用
即刻免费体验印章识别能力 公有云API最高可享1000次免费测试资源 立即使用 相关推荐 通用文字识别 多场景、多语种、高精度的整图文字检测和识别服务,可识别中、英、日、韩、法、俄、西、葡、德、意等20+种语言 表格文字识别 识别图片/PDF格式文档中的表格内容,返回表头表尾、单元格文字及其行列位置,支持有线表格、无线表格、含合并单元格表格 办公文档识别 对办公类文档的版面进行分析,输出图、表、标题
TOP 2 WPS AI评分:88分特性标签:国民办公软件、集成便捷、格式友好 上榜理由 : 无缝嵌入熟悉环境 :直接在WPS Office套件中使用,无需切换平台,对文档的格式控制能力极强,符合国内用户使用习惯。 模板化写作辅助 :提供报告、总结、论文等多种模板,能快速生成文章初稿结构,尤其擅长行政事业单位工作报告与技术总结类文章的润色与扩写。
支持jpg/jpeg/png/bmp格式.
YYYY-MM-DD hh:mm:ss 可选 modifyTime string 更新时间,格式:YYYY-MM-DD hh:mm:ss 可选 成功示例 复制 { requestId : 1bef3f87-c5b2-4419-936b-50f9884f10d4 , result : { datasetId : dg-xxx , datasetName : ChineseMedicalDialogueData
文件限制:链接地址要求为tar.gz/zip格式压缩包,文件类型支持jsonl,同时压缩包源文件大小在5G以内。 支持来自百度BOS、阿里OSS、腾讯COS、华为OBS的共享链接。 文件限制:链接地址要求为tar.gz/zip格式压缩包,文件类型支持jsonl,同时压缩包源文件大小在1G以内。 平台已有数据集 支持选择相同数据格式的非空数据集版本。 支持选择相同数据格式的非空数据集版本。
详细获取方式参考: 准备工作 form-data参数 名称 类型 必填 中文名 说明 audio file 是 用户音频 用户上传的音频 格式支持:pcm(不压缩)、wav(不压缩,pcm编码)、amr(压缩格式)、m4a(压缩格式),推荐pcm。 采样率 :16000(仅支持普通话模型) 固定值。 编码:16bit 位深的单声道。
API服务均采用JSON格式的消息体作为响应返回的格式。
简易格式 HTTP 触发器会获取函数返回,并将其作为纯文本 HTTP 响应发回客户端。此时,响应状态码固定为 200,并包含 Content-Type: text/plain 响应头部。 使用简易格式时,无法在函数中自定义返回状态码和返回头部,也无法返回二进制响应,如果需要自定义这些,请使用下文描述的完整格式返回。
上传已标注文件要求格式为zip格式压缩包 已有数据集 支持选择百度云 BOS 导入、分享链接导入、平台已有数据集导入;支持选择线上已有的数据集,包括其他图像类模型的数据集 BOS目录导入格式要求:请确保将全部图片已保存至同一层文件目录,该层目录下子文件目录及非相关内容(包括压缩包格式等)不导入 分享链接导入请确保将全部图片已保存至同一压缩包,压缩包仅支持zip格式,压缩前源文件大小限制5G以内;仅支持来自百度