Selenium使用简单的方式抓取复杂的页面信息

Selenium 简介

  网站复杂度增加,爬虫编写的方式也会随着增加。使用Selenium 可以通过简单的方式抓取复杂的网站页面,得到想要的信息。

  Selenium 是操作浏览器进行自动化,例如自动化访问网站,点击按钮,进行信息采集,对比直接使用bs4 抓取信息,Selenium的抓取速度是有很大缺陷,但是如果抓取页面不多,页面复杂时,使用Selenium是个不错的选择。

  本文将会使用Selenium 进行一些简单的抓取。

  Selenium 使用注意

  在使用 Selenium前需要安装 Selenium,使用pip命令,安装如下:

  pip install selenium

  安装完成 Selenium 还需要下载一个驱动。

  谷歌浏览器驱动:驱动版本需要对应浏览器版本,不同的浏览器使用对应不同版本的驱动。

  作者的环境说明如下:

  ·操作系统:Windows7 SP1 64

  · python 版本:3.7.7

  · 浏览器:谷歌浏览器

  · 浏览器版本: 80.0.3987 (64 位)

  下载好驱动后,必须把驱动给配置到系统环境,或者丢到你python的根目

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值