TesserOCR训练

1.CMD命令行进入 图片目录。运行:

tesseract.exe testcode.tif testcode batch.nochop makebox

注意:上面的 testcode 名称 必须保持一致。且在同一个文件夹下

程序自动在图片目录中生成 code1.box文件。

2.用jTessBoxEditor.jar 打开tif文件。

界面:

3.对程序分割结果进行校正。

(1)常用菜单解释:

  

4.校正完成后,在cmd中, cd进入图片目录,执行命令:

tesseract.exe testcode.tif testcode nobatch box.train

再执行:

unicharset_extractor.exe testcode.box

5.在图片目录中创建一个txt文件,打开,输入:

testcode    1 0 0 1 0

然后将txt文件改名文:font_properties (不带后缀)

6.执行命令:

cntraining.exe testcode.tr

7.执行命令:

mftraining.exe -F font_properties -U unicharset testcode.tr

8.在图片目录中找到 unicharset inttemp normproto pfftable,在这几个文件前面加上训练名称前缀testcode.(如testcode.unicharset)

9.执行命令:

combine_tessdata testcode.

10.将testcode.traineddata 拷贝到 tesseract-OCR目录下的tessdata目录中

转载于:https://www.cnblogs.com/iack/p/3960432.html

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值