极验滑动验证码识别教程


效果展示
我们将展示如何实现自动识别极验滑动验证码的全过程,从模拟点击到识别滑动缺口、计算位移并模拟拖动滑块。如果认证失败,则重复调用直到成功。

识别思路
模拟点击切换为滑动验证,并显示验证界面。
识别滑动缺口的位置,计算位移。
模拟拖动滑块。
若认证失败,重复调用。
详细过程及代码
初始化
首先,初始化selenium对象和一些参数配置,极验验证码测试页面的网址如下:

python

from selenium.webdriver.support import expected_conditions as EC    
from selenium import webdriver
from selenium.webdriver.support.wait import WebDriverWait
from selenium.webdriver.common.by import By
from selenium.webdriver import ActionChains
from PIL import Image
from io import BytesIO
import time

BORDER = 6

class CrackGeetest():
    def __init__(self):
        self.url = 'https://www.geetest.com/type/'
        self.browser = webdriver.Chrome()
        self.wait = WebDriverWait(self.browser,10)

    def open(self):
        '''
        打开网页
        :return None 
        '''
        self.browser.get(self.url)

    def close(self):
        '''
        关闭网页
        :return None
        '''
        self.browser.close()
        self.browser.quit()
定义了一个 CrackGeetest 类,初始化selenium对象和一些参数配置,网址是极验的验证码测试页面。

模拟点击
首先模拟点击切换为滑动验证,然后模拟点击弹出验证图片。

python

def change_to_slide(self):
    '''
    切换为滑动认证
    :return 滑动选项对象
    '''
    huadong = self.wait.until(
        EC.element_to_be_clickable((By.CSS_SELECTOR,'.products-content ul > li:nth-child(2)'))
    )
    return huadong

def get_geetest_button(self):
    '''
    获取初始认证按钮
    :return 按钮对象
    '''
    button = self.wait.until(
        EC.element_to_be_clickable((By.CSS_SELECTOR,'.geetest_radar_tip'))
    )
    return button
该步骤定义了两个方法,均利用显示等待的方法实现。并返回按钮对象,后用click()方法模拟点击。

获取背景图
首先等待验证码加载完成(wait_pic),获取网页截图(get_screenshot),然后获取验证背景图所在的位置及大小参数(get_position)和滑块对象(get_slider)。

python

def wait_pic(self):
    '''
    等待验证图片加载完成
    :return None
    '''
    self.wait.until(
        EC.presence_of_element_located((By.CSS_SELECTOR,'.geetest_popup_wrap'))
    ) 

def get_screenshot(self):
    """
    获取网页截图
    :return: 截图对象
    """
    screenshot = self.browser.get_screenshot_as_png()
    screenshot = Image.open(BytesIO(screenshot))
    return screenshot

def get_position(self):
    '''
    获取验证码位置
    :return: 位置元组
    '''
    img = self.wait.until(EC.presence_of_element_located((By.CLASS_NAME,'geetest_canvas_img')))
    time.sleep(2)
    location = img.location
    size = img.size
    top, bottom = location['y'], location['y'] + size['height']
    left, right = location['x'], location['x'] + size['width'] 
    return (top, bottom, left, right) 

def get_slider(self):
    '''
    获取滑块
    :return: 滑块对象
    '''
    slider = self.wait.until(EC.element_to_be_clickable((By.CLASS_NAME,'geetest_slider_button')))
    return slider
再通过上述返回的背景图位置和大小参数,对网页截图进行切片(get_geetest_image),最后获取背景图。

python

def get_geetest_image(self, name='captcha.png'):
    '''
    获取验证码图片
    :return: 图片对象
    '''      
    top, bottom, left, right = self.get_position()
    print('验证码位置', top, bottom, left, right)
    screenshot = self.get_screenshot()
    captcha = screenshot.crop((left, top, right, bottom))
    captcha.save(name)
    return captcha
到这里,已经获取了带缺口的背景图。我们需要获取不带缺口滑块的原图。这里通过改变CSS样式获得原图。

python

def delete_style(self):
    '''
    执行js脚本,获取无滑块图
    :return None
    '''
    js = 'document.querySelectorAll("canvas")[2].style=""'
    self.browser.execute_script(js)
执行js脚本之后(delete_style)获得了无缺口的原图,再调用之前的截图方法,就可以获取同大小的背景图。

识别缺口
我们得到了两张图,接下来对比它们来获取缺口位置。

python

def is_pixel_equal(self, img1, img2, x, y):
    '''
    判断两个像素是否相同
    :param img1: 不带缺口图片
    :param img2: 带缺口图
    :param x: 位置x
    :param y: 位置y
    :return: 像素是否相同
    '''
    pix1 = img1.load()[x, y]
    pix2 = img2.load()[x, y]
    threshold = 60
    if abs(pix1[0] - pix2[0]) < threshold \
    and abs(pix1[1] - pix2[1]) < threshold \
    and abs(pix1[2] - pix2[2]) < threshold:
        return True
    else:
        return False
get_gap()方法遍历两张图片的每个像素,再利用is_pixel_equal()方法判断两张图片同一位置的像素。

python

def get_gap(self, img1, img2):
    '''
    获取缺口偏移量
    :param img1: 不带缺口图片
    :param img2: 带缺口图
    :return 缺口位置
    '''
    left = 60 
    for i in range(left, img1.size[0]):
        for j in range(img1.size[1]):
            if not self.is_pixel_equal(img1, img2, i, j):
                left = i
                return left
    return left
模拟拖动
我们获得了滑块的位置,现在只需计算距离并模拟拖动即可。

python

def get_track(self, distance):
    '''
    根据偏移量获取移动轨迹
    :param distance: 偏移量
    :return: 移动轨迹
    '''
    track = []
    current = 0
    mid = distance * 3 / 5
    t = 0.2
    v = 0
    distance += 14
    while current < distance:
        if current < mid:
            a = 2
        else:
            a = -1.5
        v0 = v
        v = v0 + a * t
        move = v0 * t + 1 / 2 * a * t * t
        current += move
        track.append(round(move))
    return track
前3/5路程加速,后面减速,track返回的是一个列表,其中每个元素代表的是每次移动的距离。然后模拟释放鼠标时的人手抖动(shake_mouse)。

python

def shake_mouse(self):
    '''
    模拟人手释放鼠标时的抖动
    :return: None
    '''
    ActionChains(self.browser).move_by_offset(xoffset=-3, yoffset=0).perform()
    ActionChains(self.browser).move_by_offset(xoffset=2, yoffset=0).perform()

def move_to_gap(self, slider, tracks):
    '''
    拖动滑块到缺口处
    :param slider: 滑块
    :param tracks: 轨迹
    :return
    '''
    back_tracks = [-1, -1, -2, -2, -3, -2, -2, -1, -1]
    ActionChains(self.browser).click_and_hold(slider).perform()
    for x in tracks:
        ActionChains(self.browser).move_by_offset(xoffset=x, yoffset=0).perform()
    for x in back_tracks:
        ActionChains(self.browser).move_by_offset(xoffset=x, yoffset=0).perform()
    self.shake_mouse()
    time.sleep(0.5)
    ActionChains(self.browser).release().perform()
最后根据之前所得到的运动轨迹拖动滑块(move_to_gap)即可。

整个控制流程
执行主体流程,若验证失败,则再次调用crack()进行识别,直至成功。

python

def crack(self):
    try:
        self.open()
        s_button = self.change_to_slide()
        s_button.click()
        g_button = self.get_geetest_button()
        g_button.click()
        self.wait_pic()
        slider = self.get_slider()
        image1 = self.get_geetest_image('captcha1.png')
        self.delete_style()
        image2 = self.get_geetest_image('captcha2.png')
        gap = self.get_gap(image1, image2)
        print('缺口位置', gap)
        gap -= BORDER
        track = self.get_track(gap)
        self.move_to_gap(slider, track)更多内容联系1436423940
        success = self.wait.until(
            EC.text_to_be_present_in_element((By.CLASS_NAME, 'geetest_success_radar_tip_content'), '验证成功')
        )
        print(success)
        time.sleep(5)
        self.close()
    except:
        print('Failed-Retry')
        self.crack()

if __name__ == '__main__':
    crack = CrackGeetest()
    crack.crack()
至此,极验滑动验证码识别——网页截图对比方法已经记录完毕。

关键字总结
webdriver()
support.expected_conditions as EC
support.wait.WebDriverWait
ActionChains
common.by.By
BytesIO
代码风格与验证码分析思路
本文详细介绍了利用selenium和PIL库实现极验滑动验证码自动识别的方法,包括模拟点击、获取背景图、识别缺口以及模拟拖动滑块的全过程。

  • 11
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值