selenium跳过webdriver检测并模拟登录淘宝

最新推荐文章于 2023-11-09 16:35:03 发布

云外孤鸟

最新推荐文章于 2023-11-09 16:35:03 发布

阅读量6.1k

点赞数 1

文章标签： selenium taobao 淘宝爬虫

本文链接：https://blog.csdn.net/qq_33825817/article/details/88536147

版权

文章目录

简介

简介

模拟登录淘宝已经不是一件新鲜的事情了，过去我曾经使用get/post方式进行爬虫，同时也加入IP代理池进行跳过检验，但随着大型网站的升级，采取该策略比较难实现了。因为你使用get/post方式进行爬取数据，会提示需要登录，而登录又是一大难题，需要滑动验证码验证。当你想使用IP代理池进行跳过检验时，发现登录时需要手机短信验证码验证，由此可以知道旧的全自动爬取数据对于大型网站比较困难了。

selenium是一款优秀的WEB自动化测试工具，所以现在采用selenium进行半自动化爬取数据，支持模拟登录淘宝和自动处理滑动验证码。

编写思路

由于现在大型网站对selenium工具进行检测，若检测到selenium，则判定为机器人，访问被拒绝。所以第一步是要防止被检测出为机器人，如何防止被检测到呢？当使用selenium进行自动化操作时，在chrome浏览器中的consloe中输入windows.navigator.webdriver会发现结果为Ture，而正常使用浏览器的时候该值为False。所以我们将windows.navigator.webdriver进行屏蔽。
在代码中添加：

        options = webdriver.ChromeOptions()
        # 此步骤很重要，设置为开发者模式，防止被各大网站识别出来使用了Selenium
        options.add_experimental_option('excludeSwitches', [

最低0.47元/天解锁文章

云外孤鸟

关注

1
点赞
踩
23

收藏

觉得还不错? 一键收藏
12
评论
selenium跳过webdriver检测并模拟登录淘宝

文章目录简介编写思路使用教程演示图片源代码简介模拟登录淘宝已经不是一件新鲜的事情了，过去我曾经使用get/post方式进行爬虫，同时也加入IP代理池进行跳过检验，但随着大型网站的升级，采取该策略比较难实现了。因为你使用get/post方式进行爬取数据，会提示需要登录，而登录又是一大难题，需要滑动验证码验证。当你想使用IP代理池进行跳过检验时，发现登录时需要手机短信验证码验证，由此可以知道旧的全...
复制链接

扫一扫