
支持多场景、多语种、高精度识别能力,在常规文字识别基础上,精准输出每行文字的完整识别内容、置信概率、坐标位置以及四点多边形坐标数据,完整还原原图排版布局,方便开发者完成版式还原、内容矫正、图文二次加工等精细化处理。
通用文字识别被广泛用于文档电子化、图文解析、智能排版、内容抓取等业务,擅长批量提取图片内有效文字内容。

名称 | 类型 | 必须 | 说明 |
|---|---|---|---|
image | String | 否 | 图片base64 |
String | 否 | PDF文件的base64 | |
pdfNum | String | 否 | 需要识别的PDF文件的对应页码,不传默认识别第 1 页 |
ofd | String | 否 | OFD文件的base64 |
ofdNum | String | 否 | 需要识别的OFD文件的对应页码,不传默认识别第 1 页 |
file | String | 否 | 文件 |
url | String | 否 | 文件地址 |
{
"msg": "成功",// code 对应的描述
"code": 200,// 详见code返回码说明
"taskNo": "316942821199035820008485",// 本次请求号
"data": {
"resultNum": 2,//识别结果数
"result": [//识别结果
{
"words": "测试第一行",//识别结果字符串
"location": {//位置数组(坐标0点为左上角)
"top": 72,//表示定位位置的长方形左上顶点的垂直坐标
"left": 89,//表示定位位置的长方形左上顶点的水平坐标
"width": 52,//表示定位位置的长方形的宽度
"height": 12//表示定位位置的长方形的高度
},
"probability": {//表示识别结果中每一行的置信度值
"average": 0.9956096411,//行置信度平均值
"min": 0.9842295051,//行置信度最小值
"variance": 0.00003516419747//行置信度方差
},
"vertexesLocation": [//识别结果中每一行的外包四边形点坐标
{
"x": 90,//水平坐标(坐标0点为左上角)
"y": 73//垂直坐标(坐标0点为左上角)
},
{
"x": 142,
"y": 73
},
{
"x": 142,
"y": 85
},
{
"x": 90,
"y": 85
}
],
"finegrainedVertexesLocation": [//识别结果中每一行的多边形轮廓点坐标
{
"x": 89,
"y": 72
},
{
"x": 101,
"y": 72
},
{
"x": 113,
"y": 72
},
{
"x": 124,
"y": 72
},
{
"x": 136,
"y": 72
},
{
"x": 141,
"y": 72
},
{
"x": 141,
"y": 78
},
{
"x": 141,
"y": 84
},
{
"x": 130,
"y": 84
},
{
"x": 118,
"y": 84
},
{
"x": 106,
"y": 84
},
{
"x": 95,
"y": 84
},
{
"x": 89,
"y": 84
},
{
"x": 89,
"y": 78
}
]
},
],
"paragraphsResult": [//段落检测结果
{
"wordsResultIdx": [//一个段落包含的行序号
0,
1
],
"finegrainedVertexesLocation": [//识别结果中每一行的多边形轮廓点坐标
{
"x": 89,
"y": 72
},
{
"x": 101,
"y": 72
},
{
"x": 113,
"y": 72
},
{
"x": 124,
"y": 72
},
{
"x": 136,
"y": 72
},
{
"x": 141,
"y": 72
},
{
"x": 141,
"y": 72
},
{
"x": 141,
"y": 84
},
{
"x": 141,
"y": 88
},
{
"x": 141,
"y": 100
},
{
"x": 141,
"y": 100
},
{
"x": 129,
"y": 100
},
{
"x": 117,
"y": 100
},
{
"x": 104,
"y": 99
},
{
"x": 92,
"y": 99
},
{
"x": 89,
"y": 99
},
{
"x": 89,
"y": 99
},
{
"x": 89,
"y": 87
},
{
"x": 89,
"y": 84
},
{
"x": 89,
"y": 72
}
]
}
],
"paragraphsResultNum": 1,//识别结果数,表示 paragraphsResult 的元素个数
"pdfFileSize": 1//传入PDF文件的总页数,当 pdfFile 参数有效时返回该字段
}
}原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。