tesseract java 验证码_使用tesseract进行图形验证码识别

##maven

org.bytedeco.javacpp-presets

tesseract-platform

3.04.01-1.3

##配置 在resources目录下新建tessdata目录,然后从tessdata获取一个ENG.traineddata,再在tessdata目录下新建configs目录,设置几个配置文件

api_config

tessedit_zero_rejection T

表示开启tessedit_zero_rejection

digits 可以设置白名单

tessedit_char_whitelist 0123456789ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz

hocr

tessedit_create_hocr 1

tessedit_create_hocr 1,表示输出Html的意思

##使用

public static String recognize(String fileName) {

BytePointer outText;

tesseract.TessBaseAPI api = new tesseract.TessBaseAPI();

String path = OcrUtil.class.getClassLoader().getResource("").getPath();

if (api.Init(path, "ENG") != 0) {

System.err.println("Could not initialize tesseract.");

System.exit(1);

}

// api.SetVariable("tessedit_char_whitelist", "0123456789ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz");

// api.SetPageSegMode(tesseract.PSM_SINGLE_LINE);

// Open input image with leptonica library

lept.PIX image = pixRead(fileName);

api.SetImage(image);

// Get OCR result

outText = api.GetUTF8Text();

String captcha = outText.getString();

// Destroy used object and release memory

api.End();

outText.deallocate();

pixDestroy(image);

api.close();

return captcha.trim();

}

##doc

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值