在 Python 中从图像中提取文本 (OCR) 的实用指南,如何使用三个库进行光学字符识别

code2day

于 2023-01-20 08:53:35 发布

阅读量506

点赞数

分类专栏： Python源码技巧大全文章标签： python matplotlib 开发语言

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/code2day/article/details/128739677

版权

Python源码技巧大全专栏收录该内容

50 篇文章 32 订阅 ¥39.90 ¥99.00

订阅专栏

介绍

OCR 代表光学字符识别。它是一种将扫描文档和图像转换为可编辑和可搜索文本的技术。OCR 可用于从图像、PDF 和其他文档中提取文本，并且在各种场景中都非常有用。本指南将展示三个 Python 库（EasyOCR、pytesseract 和 ocrmac），并为您提供一个最基本的示例以及您可以期待的内容。作为参考，我使用的测试系统是 Apple M1 mac，Python 在 conda 中运行。

一个测试用例

许多 OCR 用例处理真实世界的图像，例如阅读路牌。这通常非常具有挑战性，因为必须处理失真和不均匀的闪电。为了演示方便，我们简化一下，截取维基百科首页。这样做的好处是可以显示多种语言，并了解具有不同字符的语言的性能如何。

简易文字识别

顾名思义，EasyOCR是一款即用型 OCR 工具。它支持超过 80 种语言，使用起来特别简单。它基于深度学习，可以使用 CUDA 进行 GPU 加速。不幸的是，还没有在 Mac 上。安装完成pip install easyocr。它基于深度学习，我们甚至可以训练或定制模型。为了将它与现有模型一起使用，我们Reader用我们选择的语言初始化类，并readtext在我们的图像上使用该方法。

import  easyocr 
reader  = easyocr.Reader([ 'en' ]) 
result = reader.readtext( 'wikipedia_test.png'

了解本专栏

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
在 Python 中从图像中提取文本 (OCR) 的实用指南,如何使用三个库进行光学字符识别

导入numpy和之后matplotlib，我们就可以安装 Rosé Pine 主题样式表了。使用wget命令，下载相应的mplstyle文件导入numpy和之后matplotlib，我们就可以安装 Rosé Pine 主题样式表了。使用wget命令，下载相应的mplstyle文件在我们使用这个主题之前，让我们先看看默认的样式表。这是前五个。但是，这会全局更改会话其余部分的样式。您可以使用上下文管理器临时设置样式，我们将在本文的其余部分执行此操作。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。