第十四天：Python下Tesseract Ocr引擎及安装介绍

穿梭的编织者

于 2025-02-19 08:52:14 发布

阅读量461

点赞数 5

CC 4.0 BY-SA版权

分类专栏： Python爬虫训练营文章标签： python 爬虫

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/kouweizhu/article/details/145638549

Python爬虫训练营专栏收录该内容

33 篇文章

订阅专栏

一、Tesseract介绍

tesseract 是一个google支持的开源ocr项目，支持多种语言的文本识别，能够识别图片中的文字并将其转换为可编辑和可搜索的数据格式，适用于文档扫描、图像处理、数字存档等多种应用场景。‌

其项目地址：https://github.com/tesseract-ocr/tesseract

目前最新的源码可以在这里下载

二、Tesseract安装包下载

官方发布的3.02版本下载地址：

http://downloads.sourceforge.net/project/tesseract-ocr-alt/tesseract-ocr-setup-3.02.02.exe?r=https%3A%2F%2Fsourceforge.net%2Fprojects%2Ftesseract-ocr-alt%2Ffiles%2F&ts=1464880498&use_mirror=jaist

德国曼海姆大学发行的3.05版本下载地址

http://digi.bib.uni-mannheim.de/tesseract/tesseract-ocr-setup-3.05.00dev.exe

imon Eigeldinger (@DomasoFan) 维护的另一个版本

http://3.onj.me/tesseract/

值得称道的是，这个网址里还有一个比较详细的说明

三、Tesseract ocr使用

安装之后，默认目录C:\Program Files (x86)\Tesseract-OCR，你需要把这个路径放到你操作系统的path搜索路径中，否则后面使用起来会不方便。

在安装目录C:\Program Files (x86)\Tesseract-OCR下可以看到 tesseract.exe这个命令行执行程序

tesseract 1.png output-l eng -psm 7

-psm 7 表示用单行文本识别 pagesegmode值：

0 =定向和脚本检测（OSD）。
1 =带OSD的自动页面分割。
2 =自动页面分割，但没有OSD或OCR
3 =全自动页面分割，但没有OSD。（默认）
4 =假设一列可变大小的文本。
5 =假设一个统一的垂直对齐文本块。
6 =假设一个统一的文本块。
7 =将图像作为单个文本行处理。
8 =把图像当作一个单词。
9 =把图像当作一个圆圈中的一个词来对待。
10 =将图像作为单个字符处理

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

穿梭的编织者 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。