tesseract_OCR识别英文


前言

本篇文章主要是学习记录使用,给大家本文章的源视频地址,虽然是英语的不过有中英双字幕,还是蛮好听懂的。


一、OCR的作用

OCR,即 Optical Character Recognition,光学字符识别,是指通过扫描字符,然后通过其形状将其翻译成电子文本的过程。通常技术中广泛流传的 OCR 指的就是“将图片转成文字”的智能技术。OCR描述原文

二、使用步骤

1.引入库

代码如下(示例):
简单使用还是仅仅依赖两个库:
pip install opencv-python
pip install pytesseract
(没下载库的)

import cv2
import pytesseract

2.单字符识别

代码如下(示例):

# 获取图像大小
img_H, img_W, _ = img.shape
# 单个图像识别数据
boxes = pytesseract.image_to_boxes(img)
# 处理图片数据
for boxe in boxes.splitlines():
    # 分割数据
    boxe = boxe.split(" ")
    # print(boxe)
    # 获取图像识别的位置坐标
    x, y, w, h = int(boxe[1]), int(boxe[2]), int(boxe[3]), int(boxe[4])
    # 添加位置方框
    cv2.rectangle(img, (x, img_H - y), (w, img_H - h), (0, 0, 255), 2)
    # 添加识别文字
    cv2.putText(img, boxe[0], (x, img_H - y + 25), cv2.FONT_HERSHEY_COMPLEX, 1, (255, 0, 0), 1)

识别结果演示:结果

3.整体识别

代码如下(示例):

# 获取图像大小
img_H, img_W
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值