Tesseract 教程

Tesseract 教程

介绍

Tesseract 是一个 OCR 库,目前由 Google 赞助(Google 也是一家以 OCR 和机器学习技术闻名于世的公司)。Tesseract 是目前公认最优秀、最精确的开源 OCR 系统,除了极高的精确度,Tesseract 也具有很高的灵活性。它可以通过训练识别出任何字体,也可以识别出任何 Unicode 字符。

安装

Window 安装

下载可执行安装文件:https://code.google.com/p/tesseract-ocr/downloads/list 安装。

Ubuntu 安装

	apt-get tesseract-ocr

Mac 安装

	brew install tesseract

安装 python 库

	pip install pytesseract

环境配置

Mac 和 Linux 环境配置

添加环境变量

	# /usr/local/share/Tesseract 为语言训练库路径,可以编辑 ~/.bash_file 终端启动时会执行这个脚本
	export TESSDATA_PREFIX=/Users/zi/Desktop/Tesseract/tessdata

Window 环境变量配置

添加环境变量

	# C:\Program Files\Tesseract OCR\Tesseract 为语言训练库路径
	setx TESSDATA_PREFIX C:\Program Files\Tesseract OCR\Tesseract

使用

命令行终端使用

显示帮助

	tesseract --help

显示当前训练语言列表

	tesseract --list-langs

识别

	tesseract 图片 输出路径 -l 训练库名称

python 代码中使用

	# 导入模块
	import pytesseract
	# 导入图片库 【注意】需要安装库: pip install Pillow
	# 导入库
	from PIL import I
  • 3
    点赞
  • 23
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值