Python图片文字识别——Windows下Tesseract-OCR的安装与使用

  1. 单击 Next 后,选择附加脚本和语言数据。

根据需要,选择附加脚本数据:

安装过程

根据需要,选择附加语言数据:

安装过程

这里选择了中文相关的附加语言包:

安装步骤

  1. 点击 Next 后,选择软件安装位置,这里使用默认位置。

安装过程

Warning: Tesseract 应该安装默认目录或新目录中,否则由于卸载程序会删除整个安装目录,会导致该目录及其所有子目录和文件被删除。

  1. 点击 Next 后,选择是否创建快捷方式,及快捷方式位置。

由于我只想使用 Tesseract API,因此此处选择不创建快捷方式,勾选 Do not create shortcuts 前复选框,如果需要快捷方式,取消勾选此复选框即可。

安装过程

  1. 点击 Install 开始安装。

安装过程

  1. 安装完成后,点击 Next

安装步骤

  1. 最后点击 Finish 完成安装。

安装步骤

Tesseract-OCR配置

将 Tesseract 添加进环境变量中。右键单击“此电脑”,选择“属性”,单击“高级系统设置”,然后单击“环境变量”,“编辑”系统环境变量“Path”,选择“新建”将 Tesseract-OCR 的安装目录(此处展示的安装目录为默认位置,如果修改了安装目录需要根据自己的安装位置进行修改)添加到环境变量中。

环境配置

确定”生效后,可以在 shell 中运行以下命令进行验证:

tesseract -v

若成功配置,则会打印版本信息:

tesseract v4.0.0.20190314

leptonica-1.78.0

libgif 5.1.4 : libjpeg 8d (libjpeg-turbo 1.5.3) : libpng 1.6.34 : libtiff 4.0.9 : zlib 1.2.11 : libwebp 0.6.1 : libopenjp2 2.2.0

Found AVX2

Found AVX

Found SSE

安装Python调用Tesseract API所需依赖项

pip install pillow

pip install pytesser3

pip install pytesseract

Tesseract-OCR测试与使用


如果需要提取的文字并非英文,则还需要下载其他语言的数据包,但是,如果在安装过程已经选择了所需的附加语言数据则不需要再次下载;否则需要在下载所需语言包后,将其置于 C:\Program Files\Tesseract-OCR\tessdata 目录下(如果修改了默认安装目录,需要根据自己的安装位置进行修改)。

语言包文件

除了直接使用程序外,还可以使用以下两种方式调用 Tesseract。

命令行模式

命令格式如下:

tesseract 输入图片的文件名 输出文件名 [-l lang][-psm pagesegmode][configfile…]

例如识别 “test.png” 图片中文字,保存至 “result.txt” 文件中。

tesseract test.png result

命令行模式

可以看到识别的准确率非常优秀。

使用 Python 调用 Tesseract API

测试使用 Tesseract 识别中文的准确率。

import pytesseract

from PIL import Image

img = Image.open(“test_1.png”)

print(pytesseract.image_to_string(img,lang=‘chi_sim’))

识别图片:

请添加图片描述

识别结果:

通过反射填充(reflection padding)减少块伪影

当我们在卷积层中将填充( padding )应上

如果你也是看准了Python,想自学Python,在这里为大家准备了丰厚的免费学习大礼包,带大家一起学习,给大家剖析Python兼职、就业行情前景的这些事儿。

一、Python所有方向的学习路线

Python所有方向路线就是把Python常用的技术点做整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照上面的知识点去找对应的学习资源,保证自己学得较为全面。

二、学习软件

工欲善其必先利其器。学习Python常用的开发软件都在这里了,给大家节省了很多时间。

三、全套PDF电子书

书籍的好处就在于权威和体系健全,刚开始学习的时候你可以只看视频或者听某个人讲课,但等你学完之后,你觉得你掌握了,这时候建议还是得去看一下书籍,看权威技术书籍也是每个程序员必经之路。

四、入门学习视频

我们在看视频学习的时候,不能光动眼动脑不动手,比较科学的学习方法是在理解之后运用它们,这时候练手项目就很适合了。

四、实战案例

光学理论是没用的,要学会跟着一起敲,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。

五、面试资料

我们学习Python必然是为了找到高薪的工作,下面这些面试题是来自阿里、腾讯、字节等一线互联网大厂最新的面试资料,并且有阿里大佬给出了权威的解答,刷完这一套面试资料相信大家都能找到满意的工作。

成为一个Python程序员专家或许需要花费数年时间,但是打下坚实的基础只要几周就可以,如果你按照我提供的学习路线以及资料有意识地去实践,你就有很大可能成功!
最后祝你好运!!!

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值