离线识别SDK
支持快速集成到移动端与客户端应用中,支持Windows、Android、iOS等主流系统,无需网络,离线即可实现智能文字识别功能


原图搭载自研TH-OCR引擎,精准定位文字大小与位置,支持多页PDF、扫描件、图片等格式的文档识别
单份文档识别耗时控制在毫秒内,满足大批量文档的高效、稳定识别
支持自动旋转、逐行矫正、滤色等图像预处理功能,提升复杂背景文档的识别效果
基于海量文档样本训练模型,识别速度快,识别准确率高
支持中文简体(手写体)、中文繁体、英文、日文、韩文等十多种语言的印刷体识别
TH-OCR对生僻字具备高精准的识别率
提供标准HTTP/HTTPS接口,集成简单便捷,免于维护
支持适配多种国产化操作系统
支持PNG、JPG、JPEG、WEBP、TIF、OFD、PDF图片与版式文件导入,识别结果支持pdf、ofd、txt、excel、word(文字流)、word(文本框)、md格式导出
李经理 133 7162 1565 info@sinosecu.com.cn
支持快速集成到移动端与客户端应用中,支持Windows、Android、iOS等主流系统,无需网络,离线即可实现智能文字识别功能
部署至本地服务器中,在私有化环境中实现文字识别功能,保障数据私密性,支持CPU/GPU环境及国产化操作系统部署
提供多种业务场景的硬件设备,如扫描仪、发票管理系统、护照阅读器、车牌识别系统等,实现物联网信息的实时计算,返回文字识别与真伪核验结果
| 一、图片为base64流 | ||||
| 接口地址: | https://netocr.com/api/recog_document_base64 | |||
| 接口调用方法: | post | |||
| 接口接收参数: | ||||
| 序号 | 名称 | 类型 | 必填 | 说明 |
| 1 | img | String | 是 | 上传的文件(图片的base64流) |
| 2 | key | String | 是 | 用户ocrKey |
| 3 | secret | String | 是 | 用户ocrSecrert |
| 4 | typeId | Integer | 是 | 识别类型:3060 |
| 5 | format | String | 是 | json |
| 6 | nLanguage | Integer | 否 |
识别语言 简体中文(印刷)0
简体中文(印刷+手写)3
繁体中文(印刷)1
繁体中文(印刷+手写)4
英文2
阿拉伯5
乌尔都6
格鲁吉亚7
西里尔文8
法文9
西班牙文10
日文11
韩文12
葡萄牙文13
越南14
孟加拉15
|
| 7 | autoRotation | Integer | 否 | 自动旋转:0 关闭(默认)、1 开启 |
| 8 | inclineCorrect | Integer | 否 | 图像校正:0-关闭(默认)、1-透视畸变校正、2-弯曲畸变校正 |
| 9 | filterColor | Integer | 否 | 颜色过滤:0-关闭(默认) 1-弱滤红 2-强滤红 3-弱滤蓝 4-强滤蓝 |
| 10 | backgroundFilter | Integer | 否 | 背景色过滤:0 关闭(默认)、1 开启 |
| 11 | removeWaterMark | Integer | 否 | 去水印:0-关闭(默认) 1-开启 |
| 12 | layout | Integer | 否 | 版面分析:0 关闭(默认)、1 开启 |
| 13 | subscript | Integer | 否 | 角标识别:0 关闭(默认)、1 开启 |
| 14 | lineProcess | Integer | 否 | 逐行校正:0 关闭(默认)、1 开启 |
| 15 | imageSegmentation | Integer | 否 | 超大图切分:0 关闭(默认)、1 开启 |
| 二、图片为file格式 | ||||
| 接口地址: | https://netocr.com/api/recog_document_file | |||
| 接口调用方法: | post | |||
| 接口接收参数: | ||||
| 序号 | 名称 | 类型 | 必填 | 说明 |
| 1 | file | MultipartFile | 是 | 上传的文件(上传文件的字段名必须是“file”) |
| 2 | key | String | 是 | 用户ocrKey |
| 3 | secret | String | 是 | 用户ocrSecrert |
| 4 | typeId | Integer | 是 | 识别类型:3060 |
| 5 | format | String | 是 | json |
| 6 | nLanguage | Integer | 否 |
识别语言 简体中文(印刷)0
简体中文(印刷+手写)3
繁体中文(印刷)1
繁体中文(印刷+手写)4
英文2
阿拉伯5
乌尔都6
格鲁吉亚7
西里尔文8
法文9
西班牙文10
日文11
韩文12
葡萄牙文13
越南14
孟加拉15
|
| 7 | autoRotation | Integer | 否 | 自动旋转:0 关闭(默认)、1 开启 |
| 8 | inclineCorrect | Integer | 否 | 图像校正:0-关闭(默认)、1-透视畸变校正、2-弯曲畸变校正 |
| 9 | filterColor | Integer | 否 | 颜色过滤:0-关闭(默认) 1-弱滤红 2-强滤红 3-弱滤蓝 4-强滤蓝 |
| 10 | backgroundFilter | Integer | 否 | 背景色过滤:0 关闭(默认)、1 开启 |
| 11 | removeWaterMark | Integer | 否 | 去水印:0-关闭(默认) 1-开启 |
| 12 | layout | Integer | 否 | 版面分析:0 关闭(默认)、1 开启 |
| 13 | subscript | Integer | 否 | 角标识别:0 关闭(默认)、1 开启 |
| 14 | lineProcess | Integer | 否 | 逐行校正:0 关闭(默认)、1 开启 |
| 15 | imageSegmentation | Integer | 否 | 超大图切分:0 关闭(默认)、1 开启 |
| 三、识别文件下载 | ||||
| 接口地址: | https://netocr.com/api/download_file | |||
| 接口调用方法: | post | |||
| 接口接收参数: | ||||
| 序号 | 名称 | 类型 | 必填 | 说明 |
| 1 | consumeId | String | 是 | 识别结果返回的唯一id |
| 2 | num | String | 是 | 识别结果返回的num 1-1 代表下载第一页的文件 1-10 代表下载所有页的文件(总共10页) 2-10 代表下载2-10页的文件(总共10页) |
| 3 | type | String | 是 |
pdf --双层pdf文件 txt --txt文本文件 ofd --ofd文件 xls --excel文件 flowWord --文字流word boxWord --文本框word md --md文件 |
| 四、示例代码 | ||||
|
||||
| 查看详细API介绍 | ||||