通过程序识别点触验证码

最新推荐文章于 2024-07-23 22:38:20 发布

asfdsgdf

最新推荐文章于 2024-07-23 22:38:20 发布

阅读量651

点赞数 14

文章标签：深度学习 YOLO

本文链接：https://blog.csdn.net/asfdsgdf/article/details/140071853

版权

1. 本节目标
本节我们的目标是通过编写程序实现对点触验证码的自动识别和验证。

2. 准备工作
我们将使用 Python 的 Selenium 库和 Chrome 浏览器来实现目标。在开始之前，请确保您已经安装好了 Selenium 库和 Chrome 浏览器，并配置好了 ChromeDriver。相关的安装和配置步骤请参考之前的章节。

3. 了解点触验证码
点触验证码是一种需要用户点击特定位置进行验证的验证码形式。类似于 12306 网站的验证码，需要点击图像中的特定文字或图案。由于验证码的复杂性和多样性，图像识别的难度较大。为了实现自动化，我们将借助第三方验证码识别服务。

4. 识别思路
通过图像识别技术直接识别点触验证码难度较大，尤其是复杂的文字和图像。识别难点包括文字的变形、模糊处理等，使得 OCR（光学字符识别）技术难以准确识别。因此，我们将借助第三方平台，如超级鹰，来实现验证码的自动识别。这些平台通过人工和机器结合的方式，提供高准确率的验证码识别服务。

5. 注册账号
首先，我们需要注册一个超级鹰账号并申请一个软件 ID。可以在超级鹰官网进行注册。注册完成后，前往开发者中心添加一个软件 ID，并充值一些题分。

6. 获取 API
超级鹰提供了 Python API，用于与其服务对接。以下是适用于 Python 3 的 API 代码：

python

import requests
from hashlib import md5

class Chaojiying(object):
def __init__(self, username, password, soft_id):
self.username = username
self.password = md5(password.encode('utf-8')).hexdigest()
self.soft_id = soft_id
self.base_params = {
'user': self.username,
'pass2': self.password,
'softid': self.soft_id,
}
self.headers = {
'Connection': 'Keep-Alive',
'User-Agent': 'Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0)',
}

def post_pic(self, im, codetype):
params = {
'codetype': codetype,
}
params.update(self.base_params)
files = {'userfile': ('captcha.jpg', im)}
r = requests.post('http://upload.chaojiying.net/Upload/Processing.php', data=params, files=files, headers=self.headers)
return r.json()

def report_error(self, im_id):
params = {
'id': im_id,
}
params.update(self.base_params)
r = requests.post('http://upload.chaojiying.net/Upload/ReportError.php', data=params, headers=self.headers)
return r.json()
7. 初始化
首先，我们初始化一些变量和对象，如 WebDriver 和 Chaojiying 对象：

python

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from PIL import Image
from io import BytesIO
import time

EMAIL = 'your_email@example.com'
PASSWORD = 'your_password'
CHAOJIYING_USERNAME = 'your_username'
CHAOJIYING_PASSWORD = 'your_password'
CHAOJIYING_SOFT_ID = 'your_soft_id'
CHAOJIYING_KIND = 9102

class CrackTouClick():
def __init__(self):
self.url = 'http://admin.touclick.com/login.html'
self.browser = webdriver.Chrome()
self.wait = WebDriverWait(self.browser, 20)
self.email = EMAIL
self.password = PASSWORD
self.chaojiying = Chaojiying(CHAOJIYING_USERNAME, CHAOJIYING_PASSWORD, CHAOJIYING_SOFT_ID)
8. 获取验证码
我们需要填写表单并触发验证码的显示：

python

def open(self):
self.browser.get(self.url)
email = self.wait.until(EC.presence_of_element_located((By.ID, 'email')))
password = self.wait.until(EC.presence_of_element_located((By.ID, 'password')))
email.send_keys(self.email)
password.send_keys(self.password)

def get_touclick_button(self):
button = self.wait.until(EC.element_to_be_clickable((By.CLASS_NAME, 'touclick-hod-wrap')))
return button
然后获取验证码图片的位置和大小，并从网页截图中截取验证码图片：

python

def get_touclick_element(self):
element = self.wait.until(EC.presence_of_element_located((By.CLASS_NAME, 'touclick-pub-content')))
return element

def get_position(self):
element = self.get_touclick_element()
time.sleep(2)
location = element.location
size = element.size
top, bottom, left, right = location['y'], location['y'] + size['height'], location['x'], location['x'] + size['width']
return (top, bottom, left, right)

def get_screenshot(self):
screenshot = self.browser.get_screenshot_as_png()
screenshot = Image.open(BytesIO(screenshot))
return screenshot

def get_touclick_image(self):
top, bottom, left, right = self.get_position()
screenshot = self.get_screenshot() 更多内容联系1436423940
captcha = screenshot.crop((left, top, right, bottom))
return captcha
9. 识别验证码
调用 Chaojiying 对象的 post_pic 方法进行识别，并解析返回的结果：

python

def recognize_captcha(self):
image = self.get_touclick_image()
bytes_array = BytesIO()
image.save(bytes_array, format='PNG')
result = self.chaojiying.post_pic(bytes_array.getvalue(), CHAOJIYING_KIND)
return result

def get_points(self, captcha_result):
groups = captcha_result.get('pic_str').split('|')
locations = [[int(number) for number in group.split(',')] for group in groups]
return locations

def touch_click_words(self, locations):
for location in locations:
ActionChains(self.browser).move_to_element_with_offset(self.get_touclick_element(), location[0], location[1]).click().perform()
time.sleep(1)
识别完成后，将解析后的坐标进行点击操作：

python

def main(self):
self.open()
button = self.get_touclick_button()
button.click()
captcha_result = self.recognize_captcha()
locations = self.get_points(captcha_result)
self.touch_click_words(locations)
# 继续进行登录操作

asfdsgdf

关注

14
点赞
踩
13

收藏

觉得还不错? 一键收藏
0
评论
通过程序识别点触验证码

通过图像识别技术直接识别点触验证码难度较大，尤其是复杂的文字和图像。因此，我们将借助第三方平台，如超级鹰，来实现验证码的自动识别。这些平台通过人工和机器结合的方式，提供高准确率的验证码识别服务。点触验证码是一种需要用户点击特定位置进行验证的验证码形式。类似于 12306 网站的验证码，需要点击图像中的特定文字或图案。由于验证码的复杂性和多样性，图像识别的难度较大。为了实现自动化，我们将借助第三方验证码识别服务。可以在超级鹰官网进行注册。本节我们的目标是通过编写程序实现对点触验证码的自动识别和验证。
复制链接

扫一扫