Python完美采集淘宝数据,含完整源代码和视频教程

 目录

前言

准备

分析(x0)

分析(x1)

分析(x2)

分析(x3)

分析(x4)

总结

我有话说


前言

大家好,我叫善念。不说漂亮话,直接开始今天要采集的目标:某宝数据

今天要采用的方式是selenium自动化工具。

简单说下selenium的原理——利用网页元素控制浏览器。

准备

安装selenium模块:

pip install selenium

我采用的是利用selenium控制Chrome浏览器,所以咱们需要下载一个selenium与Chrome的桥梁——Chromedriver插件

下载地址

下载与你当前谷歌浏览器版本最相近的Chromedriver

那么像我的话,下载 即可。

Windows系统需下载32位,其它的自己看着办。点进去下载win32即可。

 那么如何让Python与selenium连接起来呢,这里咱们需要配置一个环境变量,就是把Python与selenium处于同一个目录:

到此为止,咱们的环境就搭建好了。

分析(x0)

登录篇

 谈谈selenium与requests的区别:

selenium:操控网页元素,模拟人去控制浏览器,放弃与底层协议的交互,控制于客户端表面(速度慢)

requests:模拟客户端像服务器发送协议请求,处于底层协议的交互。(速度快)

既然是模拟人去控制浏览器就好说了,想要采集某个网站第一步是做什么?

实例化一款需要被控制的浏览器,然后打开该网址:

from selenium import webdriver
driver = webdr
  • 0
    点赞
  • 11
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值