Tesseract 安装和使用简介

Tesseract 教程

介绍

Tesseract 是一个 OCR 库,目前由 Google 赞助(Google 也是一家以 OCR 和机器学习技术闻名于世的公司)。Tesseract 是目前公认最优秀、最精确的开源 OCR 系统,除了极高的精确度,Tesseract 也具有很高的灵活性。它可以通过训练识别出任何字体,也可以识别出任何 Unicode 字符。

安装

Window 安装

下载可执行安装文件:https://code.google.com/p/tesseract-ocr/downloads/list 安装。

Ubuntu 安装

    apt-get install tesseract-ocr   (如果出现权限不够,可以命令前面加上sudo)

Mac 安装

    brew install tesseract

安装 python 库

    pip install pytesseract

环境配置

Mac 和 Linux 环境配置

添加环境变量

    # /usr/local/share/Tesseract 为语言训练库包的路径,可以编辑。或者直接把下载好的包丢到下面命令等号之后即可 ~/.bash_file
    export TESSDATA_PREFIX=/usr/local/share/Tesseract

Window 环境变量配置

添加环境变量

    # C:\Program Files\Tesseract OCR\Tesseract 为语言训练库路径
    setx TESSDATA_P
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值