首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >通用文字识别-通用文字OCR-文字识别接口介绍

通用文字识别-通用文字OCR-文字识别接口介绍

原创
作者头像
聚美智数
发布2026-07-24 17:42:42
发布2026-07-24 17:42:42
590
举报

前言

传统人工录入图文资料存在效率低、出错率高、无法留存文字位置版式信息等问题。本通用文字识别 API 依托深度学习优化算法,识别精度最高可达 99.9%,支持图片、PDF、OFD 文件解析,同步返回文本坐标、轮廓点位、段落结构与置信度数据;可快速对接各类业务系统,完成图像文字结构化、版式还原等智能化处理。

通用文字识别在以下场景中应用广泛:

  1. 政务档案数字化
  2. 财务单据自动处理
  3. 资质证件信息采集
  4. 固化电子文档解析
  5. 日常图文文字提取
  6. 工业资产信息采集
  7. 版面还原与标注开发
  8. 企业办公自动化

API介绍

请求说明

名称

类型

必须

说明

image

String

图片base64

pdf

String

PDF文件的base64

pdfNum

String

需要识别的PDF文件的对应页码,不传默认识别第 1 页

ofd

String

OFD文件的base64

ofdNum

String

需要识别的OFD文件的对应页码,不传默认识别第 1 页

file

File

文件

url

String

文件地址

  • image、pdf、ofd、file、url 必须提供一个,优先级:image > pdf > ofd > file > url
  • 文件不超过4M,最短边至少15px,最长边最大4096px
  • 图片格式为 jpg、png、bmp、jpeg

返回样例

代码语言:javascript
复制
{
  "msg": "成功",// code 对应的描述
  "code": 200,// 详见code返回码说明
  "taskNo": "316942821199035820008485",// 本次请求号
  "charge": true, // 计费标志
  "data": {
    "resultNum": 2,//识别结果数
    "result": [//识别结果
      {
        "words": "测试第一行",//识别结果字符串
        "location": {//位置数组(坐标0点为左上角)
          "top": 72,//表示定位位置的长方形左上顶点的垂直坐标
          "left": 89,//表示定位位置的长方形左上顶点的水平坐标
          "width": 52,//表示定位位置的长方形的宽度
          "height": 12//表示定位位置的长方形的高度
        },
        "probability": {//表示识别结果中每一行的置信度值
          "average": 0.9956096411,//行置信度平均值
          "min": 0.9842295051,//行置信度最小值
          "variance": 0.00003516419747//行置信度方差
        },
        "vertexesLocation": [//识别结果中每一行的外包四边形点坐标
          {
            "x": 90,//水平坐标(坐标0点为左上角)
            "y": 73//垂直坐标(坐标0点为左上角)
          },
          {
            "x": 142,
            "y": 73
          },
          {
            "x": 142,
            "y": 85
          },
          {
            "x": 90,
            "y": 85
          }
        ],
        "finegrainedVertexesLocation": [//识别结果中每一行的多边形轮廓点坐标
          {
            "x": 89,
            "y": 72
          },
          {
            "x": 101,
            "y": 72
          },
          {
            "x": 113,
            "y": 72
          },
          {
            "x": 124,
            "y": 72
          },
          {
            "x": 136,
            "y": 72
          },
          {
            "x": 141,
            "y": 72
          },
          {
            "x": 141,
            "y": 78
          },
          {
            "x": 141,
            "y": 84
          },
          {
            "x": 130,
            "y": 84
          },
          {
            "x": 118,
            "y": 84
          },
          {
            "x": 106,
            "y": 84
          },
          {
            "x": 95,
            "y": 84
          },
          {
            "x": 89,
            "y": 84
          },
          {
            "x": 89,
            "y": 78
          }
        ]

      },
    ],
    "paragraphsResult": [//段落检测结果
      {
        "wordsResultIdx": [//一个段落包含的行序号
          0,
          1
        ],
        "finegrainedVertexesLocation": [//识别结果中每一行的多边形轮廓点坐标
          {
            "x": 89,
            "y": 72
          },
          {
            "x": 101,
            "y": 72
          },
          {
            "x": 113,
            "y": 72
          },
          {
            "x": 124,
            "y": 72
          },
          {
            "x": 136,
            "y": 72
          },
          {
            "x": 141,
            "y": 72
          },
          {
            "x": 141,
            "y": 72
          },
          {
            "x": 141,
            "y": 84
          },
          {
            "x": 141,
            "y": 88
          },
          {
            "x": 141,
            "y": 100
          },
          {
            "x": 141,
            "y": 100
          },
          {
            "x": 129,
            "y": 100
          },
          {
            "x": 117,
            "y": 100
          },
          {
            "x": 104,
            "y": 99
          },
          {
            "x": 92,
            "y": 99
          },
          {
            "x": 89,
            "y": 99
          },
          {
            "x": 89,
            "y": 99
          },
          {
            "x": 89,
            "y": 87
          },
          {
            "x": 89,
            "y": 84
          },
          {
            "x": 89,
            "y": 72
          }
        ]

      }
    ],
    "paragraphsResultNum": 1,//识别结果数,表示 paragraphsResult 的元素个数
    "pdfFileSize": 1//传入PDF文件的总页数,当 pdfFile 参数有效时返回该字段
  }
}

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 前言
  • API介绍
    • 请求说明
    • 返回样例
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档