爬虫你还在用selenium吗，out了！

最新推荐文章于 2024-05-28 08:06:15 发布

aobulaien001

最新推荐文章于 2024-05-28 08:06:15 发布

阅读量990

点赞数 19

文章标签：爬虫 selenium 测试工具

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/aobulaien001/article/details/135363249

版权

最近遇到了一件事情：我的chrome浏览器升级了，但是对应的webdriver还没有升级，我只能被迫的接受使用safari浏览器实现爬虫。

虽然是mac自带的浏览器，但是我chrome浏览器用惯了，改不过来习惯了。但是最近发新闻还是被迫的使用safari浏览器作为浏览器。

我也一直在从slenium作为爬虫的框架，它主要webdriver，这样就有了诸多的问题：

配置比较麻烦，对于新手可能不是很友好
版本必须和浏览器的版本匹配。我之前的一段时间就是因为chrome升级了，但是driver没升级导致无法使用脚本操作服务器
selenium新版本的api和老版本的出入较大。之前在解决问题时，发现很多旧文档中给的代码案例在新的版本中已经不能用了

好了，现在救星来了，slenium作为爬虫工具已经成为了历史。

DrissionPage 是一个基于 python 的网页自动化工具。它既能控制浏览器，也能收发数据包，还能把两者合而为一。可兼顾浏览器自动化的便利性和 requests 的高效率。它功能强大，内置无数人性化设计和便捷功能。它的语法简洁而优雅，代码量少，对新手友好。

这引自DrissionPage官方的文档，但是具体怎么样，还是得去看看吧。来和shigen一起探索吧。

安装

 pip install DrissionPage

成功的安装

代码测试

根据官方的案例：采集猫眼电影top100榜，我们直接复制粘贴代码。

获得猫眼top100榜单的代码

我就等了几秒钟的样子，它打开了一个新的web tab页面，就在疯狂的分页，之后数据全部放在了data.csv里边了。

爬取的榜单信息

这个比之前用requests库简单多了！

shigen直呼过瘾，下边的代码我就要自己去造了！爬取极简壁纸。不过也有点心疼作者，免费的网站，还要承受这样的流量攻击。果然应证了那句话：免费的才是最贵的！

代码就是这么的简单，但是最后还是没下载成功，前端处理了一下文件的地址。

爬取的图片地址

相信我们后期会得到好的解决办法，shigen也会持续的更新。总之，drissionPage这个框架太好用了！

更多的使用方法，大家也可以去查看一下文档。

以上就是今天分享的全部内容了，觉得不错的话，记得点赞在看关注支持一下哈，您的鼓励和支持将是shigen坚持日更的动力。同时，shigen在多个平台都有文章的同步，也可以同步的浏览和订阅：

---------------------------END---------------------------

题外话

在这里插入图片描述

感兴趣的小伙伴，赠送全套Python学习资料，包含面试题、简历资料等具体看下方。

👉CSDN大礼包🎁：全网最全《Python学习资料》免费赠送🆓！（安全链接，放心点击）

一、Python所有方向的学习路线

Python所有方向的技术点做的整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照下面的知识点去找对应的学习资源，保证自己学得较为全面。

二、Python兼职渠道推荐*

学的同时助你创收，每天花1-2小时兼职，轻松稿定生活费.
在这里插入图片描述

三、最新Python学习笔记

当我学到一定基础，有自己的理解能力的时候，会去阅读一些前辈整理的书籍或者手写的笔记资料，这些笔记详细记载了他们对一些技术点的理解，这些理解是比较独到，可以学到不一样的思路。

四、实战案例

纸上得来终觉浅，要学会跟着视频一起敲，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。

👉CSDN大礼包🎁：全网最全《Python学习资料》免费赠送🆓！（安全链接，放心点击）

若有侵权，请联系删除

关注

19
点赞
踩
24

收藏

觉得还不错? 一键收藏
0
评论
爬虫你还在用selenium吗，out了！

最近遇到了一件事情：我的chrome浏览器升级了，但是对应的webdriver还没有升级，我只能被迫的接受使用safari浏览器实现爬虫。虽然是mac自带的浏览器，但是我chrome浏览器用惯了，改不过来习惯了。但是最近发新闻还是被迫的使用safari浏览器作为浏览器。好了，现在救星来了，slenium作为爬虫工具已经成为了历史。DrissionPage 是一个基于 python 的网页自动化工具。它既能控制浏览器，也能收发数据包，还能把两者合而为一。
复制链接

扫一扫

aobulaien001 CSDN认证博客专家 CSDN认证企业博客

码龄5年

714: 原创

17万+: 周排名

2034: 总排名

62万+: 访问

: 等级

1万+: 积分

5054: 粉丝

7170: 获赞

19: 评论

7676: 收藏

私信

关注

热门文章

分类专栏

Python 5篇
计算机 5篇
网络安全 2篇

最新评论

深入浅出Python日志打印
北风之神c: 总结的很全面，写得赞，博主用心了。此国产日志 https://nb-log-doc.readthedocs.io/zh_CN/latest 使用原生 loggng封装，兼容性和替换性100%,大幅简化logging的使用。 1、日志能根据级别能够自动变彩色。 1 2、print自动变彩色。 3、日志和print在pycahrm控制台的输出都自动可以点击跳转到文件和行号。 4、多进程日志切割安全，文件日志写入性能高。 5、入参简单，能一键自动记录到多种地方。 6、 nb_log 兼容包含loguru色彩模式,loguru只是nb_log的子集之一. 相比 loguru 有10胜。 pip install nb_log 。
python如何安装各种库（保姆级教程）
YOUMuu: cmd是反人类的东西
Python Selenium：网页自动化的利器
xtfw99: Selenium语法已经更新很多了，你这是老旧版的语法了。
Django使用Celery异步发送邮件
北风之神c: 总结的很全面，写得赞，博主用心了。 celery对目录层级文件名称格式要求太高，只适合规划新的项目，对不规则文件夹套用难度高。所以新手使用celery很仔细的建立文件夹名字、文件夹层级、python文件名字。所以网上的celery博客教程虽然很多，但是并不能学会使用，因为要运行起来需要以下6个方面都掌握好，博客文字很难表达清楚或者没有写全面以下6个方面。 celery消费任务不执行或者报错NotRegistered，与很多方面有关系，如果要别人排错，至少要发以下6方面的截图，因为与一下6点关系很大。 1)整个项目目录结构, 2）@task入参 ,3）celery的配置，4）celery的配置 include ,5）cmd命令行启动参数 --queues= 的值,6）用户在启动cmd命令行时候，用户所在的文件夹。在不规范的文件夹路径下，使用celery难度很高，一般教程都没教。 [项目文件夹目录格式不规范下的celery使用演示](https://github.com/ydf0509/celery_demo) 。此国产分布式函数调度框架 funboost python万能通用函数加速器 https://funboost.readthedocs.io/ ，从用法调用难度，用户所需代码量，超高并发性能，qps控频精确程度，支持的中间件类型，任务控制方式，稳定程度等19个方面全方位超过celery。发布性能提高1000%，消费性能提高2000%。 python万能分布式函数调度框架funboost支持python所有类型的并发模式和一切知名消息队列中间件，python函数加速器，框架包罗万象,万能编程功能宝典，一统编程思维，与业务不绑定，适用范围广。 funboot能支持celery作为中间件，用户可以使用funboost的极简api来使用celery核心调度，不用手动复杂的配置操作celery funboost 自动化操作celery https://github.com/ydf0509/funboost_support_celery_demo pip install funboost
python如何安装各种库（保姆级教程）
damncodeerror: 本地安装的方法很顺畅，按照步骤来就能顺利安装上，就是不知道应该下哪个版本

大家在看

最新文章

2024

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。