Tess4J和TesseractOCR简易使用教程

最新推荐文章于 2024-05-14 21:06:11 发布

李博寒

最新推荐文章于 2024-05-14 21:06:11 发布

阅读量1.8k

点赞数 1

文章标签： java ocr

本文链接：https://blog.csdn.net/Bad_Guy_Shrek/article/details/106279193

版权

使用Tess4J和TesseractOCR实现对图片文字的识别提取

背景：OCR场景识别主要使用 TesseractOCR和tess4J，Tesseract主要优势表现在中文文字识别的准确度和速率，tess4J识别英文的效果较好，且可移植性较高（中文识别效果可经训练后达到较好的效果），本次主要记录Tess4J和tesseractOCR的使用方法

TesseractOCR的简易使用：
1、安装tesseractOCR(安装包下载地址： http://digi.bib.uni-mannheim.de/tesseract/tesseract-ocr-setup-4.00.00dev.exe)
2、下载完成后进行安装（可根据自己需要下载所需语言包，这里我下载的是中英文的语言包）如果有其它语言的要求可以去github上自行下载（https://github.com/tesseract-ocr/tessdata）下载完成后放入tessdata目录下
3、配置环境变量：
path：C:\Program Files (x86)\Tesseract-OCR
新增系统变量：
TESSDATA_PREFIX
C:\Program Files (x86)\Tesseract-OCR\tessdata
4、配置完成后，控制台 tesseract --version可查看对应版本
5、使用 tesseract xxx.jpg test -l chi_sim命令实现文字的提取和识别（不过这个识别成功率不是很好，可以通过训练字库的方式

最低0.47元/天解锁文章

李博寒

关注

1
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
Tess4J和TesseractOCR简易使用教程

使用Tess4J和TesseractOCR实现对图片文字的识别提取背景：OCR场景识别主要使用 TesseractOCR和tess4J，Tesseract主要优势表现在中文文字识别的准确度和速率，tess4J识别英文的效果较好，且可移植性较高（中文识别效果可经训练后达到较好的效果），本次主要记录Tess4J和tesseractOCR的使用方法TesseractOCR的简易使用：1、安装tesseractOCR(安装包下载地址： http://digi.bib.uni-mannheim.de/tesse
复制链接

扫一扫