selenium python 获取验证码_selenium+Python3.5获取验证码

其中PIL为Python Imaging Library,已经是Python平台事实上的图像处理标准库了。PIL功能非常强大,但API却非常简单易用。

PIL第三方库安装 pip install PIL

Image 类是 PIL 库中一个非常重要的类,通过这个类来创建实例可以有直接载入图像文件,读取处理过的图像和通过抓取的方法得到的图像这三种方法。

python中PIL模块中有一个叫做ImageEnhance的类,该类专门用于图像的增强处理,不仅可以增强(或减弱)图像的亮度、对比度、色度,还可以用于增强图像的锐度。

环境:Windows7  64位、python3.5、selenium3.8

一、安装PIL

打开dos命令窗口,进入python安装目录C:\Python\Scripts,输入:pip install pillow 。如下图:

二、安装Tesseract

tessdata 目录存放的是语言字库文件,和在命令行界面中可能用到的参数所对应的文件. 这个安装程序默认包含了英文字库。

详解可参见:http://www.cnblogs.com/wzben/p/5930538.html

三、安装pytesseract

Tesseract并不能直接在python中使用,需要使用python的封装类pytesseract

Python-tesseract 是光学字符识别Tesseract OCR引擎的Python封装类。能够读取任何常规的图片文件(JPG, GIF ,PNG , TIFF等)并解码成可读的语言。在OCR处理期间不会创建任何临文件

打开dos命令窗口,进入python安装目录C:\Python\Scripts,输入:pip install pytesseract 。如下图:

四、获取验证码(下面的代码只能获取英文字符和数字,中文获取不到,为空)

1 rom selenium importwebdriver2 from PIL importImage3 from PIL importImageEnhance4 importpytesseract5

6 driver=webdriver.Firefox()7 url="https://passport.baidu.com/?getpassindex"

8 driver.get(url)9 driver.save_screenshot(r"E:\aa.png") #截取当前网页,该网页有我们需要的验证码

10 imgelement = driver.find_element_by_xpath(".//*[@id='forgotsel']/div/div[3]/img")11 location = imgelement.location #获取验证码x,y轴坐标

12 size=imgelement.size #获取验证码的长宽

13 coderange=(int(location['x']),int(location['y']),int(location['x']+size['width']),14 int(location['y']+size['height'])) #写成我们需要截取的位置坐标

15 i=Image.open(r"E:\aa.png") #打开截图

16 frame4=i.crop(coderange) #使用Image的crop函数,从截图中再次截取我们需要的区域

17 frame4.save(r"E:\frame4.png")18 i2=Image.open(r"E:\frame4.png")19 imgry = i2.convert('L') #图像加强,二值化,PIL中有九种不同模式。分别为1,L,P,RGB,RGBA,CMYK,YCbCr,I,F。L为灰度图像

20 sharpness =ImageEnhance.Contrast(imgry)#对比度增强

21 i3 = sharpness.enhance(3.0) #3.0为图像的饱和度

22 i3.save("E:\\image_code.png")23 i4=Image.open("E:\\image_code.png")24 text=pytesseract.image_to_string(i4).strip() #使用image_to_string识别验证码

25 print(text)

View Code

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值