python+selenium+PIL+tesseract验证码识别

最新推荐文章于 2022-01-12 17:00:21 发布

weixin_34159110

最新推荐文章于 2022-01-12 17:00:21 发布

阅读量75

点赞数

文章标签：人工智能 python 测试

原文链接：http://www.cnblogs.com/mtfan01/p/9077760.html

版权

一段简单的验证码识别，不过tesseract验证码识别很差，试了十几次只成功过两次，对结果不满意就当是学会一样新的技术吧

 1 from selenium import webdriver
 2 from time import sleep
 3 import unittest
 4 from PIL import Image
 5 from PIL import ImageEnhance
 6 import pytesseract
 7 driver=webdriver.Firefox()
 8 url="https://passport.baidu.com/?getpassindex"
 9 driver.get(url)
10 driver.maximize_window()
11 driver.save_screenshot(r"E:\aa.png")  #截取当前网页，该网页有我们需要的验证码
12 imgelement = driver.find_element_by_xpath(".//*[@id='forgotsel']/div/div[3]/img")
13 #imgelement = driver.find_element_by_id("code")  #定位验证码
14 location = imgelement.location  #获取验证码x,y轴坐标
15 print (location)
16 size=imgelement.size  #获取验证码的长宽
17 print(size)
18 coderange=(int(location['x']),int(location['y']),int(location['x']+size['width']),
19            int(location['y']+size['height'])) #写成我们需要截取的位置坐标
20 i=Image.open(r"E:\aa.png") #打开截图
21 frame4=i.crop(coderange)  #使用Image的crop函数，从截图中再次截取我们需要的区域
22 frame4.save(r"E:\frame4.png")
23 i2=Image.open(r"E:\frame4.png")
24 imgry = i2.convert('L')   #图像加强，二值化，PIL中有九种不同模式。分别为1，L，P，RGB，RGBA，CMYK，YCbCr，I，F。L为灰度图像
25 sharpness =ImageEnhance.Contrast(imgry)#对比度增强
26 i3 = sharpness.enhance(3.0)  #3.0为图像的饱和度
27 i3.save("E:\\image_code.png")
28 i4=Image.open("E:\\image_code.png")
29 text=pytesseract.image_to_string(i4)#使用image_to_string识别验证码
30 print (text)

code

转载于:https://www.cnblogs.com/mtfan01/p/9077760.html

weixin_34159110

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

weixin_34159110 CSDN认证博客专家 CSDN认证企业博客

码龄9年

132: 原创

-: 周排名

124万+: 总排名

134万+: 访问

: 等级

7365: 积分

7026: 粉丝

210: 获赞

21: 评论

1157: 收藏

私信

关注

热门文章

最新评论

微信扫描二维码登录网站技术原理
2401_85165867: 高科技
keras 自定义 metrics
weixin_58514592: 您好，我使用您的方法以后，有一个奇怪的报错，TypeError: __array__() takes 1 positional argument but 2 were given。我在使用内置的函数的时候，metrics=['sparse_categorical_accuracy']，是正常跑的。但是我一旦使用，metrics=['accuracy',mean_pred]这种自定义函数的时候，就会出现TypeError: __array__() takes 1 positional argument but 2 were given。报错。我自定义的损失函数是预测值与真实值误差小于阈值就认为是真，通过统计真的个数占全部预测样本的总数百分之判断准确率，def mean_pred(y_true, y_pred): m = y_true.shape[0] pre_ture = [] y_true = scaler2.inverse_transform(y_true) y_pred = scaler2.inverse_transform(y_pred) threshold = 50 # 定义一个阈值，作为预测值与真实值之间的差值 error = y_true - y_pred # 真实值与误差值之间的偏差 is_small_error = tf.abs(error) <= threshold for pre in is_small_error: if pre == True: pre_ture.append(pre) n = len(pre_ture) accuracy_pre = n/m return accuracy_pre 我返回值明明是一个但是就是一直报错。
win下使用git-bash工具进行ssh免密登录服务器
Tisfy: 总结得十分精辟，就像那：更愿诸公著意，休教忘了中原。
深度强化学习DQN(Deep Q Network)原理及例子：如何解决迷宫问题，附源码
妙脆角不妙了: 老哥，你这算法换张地图还好使吗
如何将日志文件和二进制文件快速导入HDFS？
ITshu: 二进制文件在哪里？

大家在看

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。