【Python】完美采集淘宝数据（附完整源代码和视频教程）

最新推荐文章于 2024-07-01 12:35:25 发布

m0_60607971

最新推荐文章于 2024-07-01 12:35:25 发布

阅读量1k

点赞数 10

分类专栏：程序员文章标签： python 开发语言

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_60607971/article/details/138360858

版权

本文介绍了如何使用Python的selenium库控制Chrome浏览器，配合Chromedriver插件采集淘宝数据。首先安装selenium，然后配置环境变量，实现Python与selenium的连接。接着，通过元素定位进行输入搜索、点击操作，模拟用户行为。文章强调了XPath在定位网页元素中的作用，并提供了滚动页面加载更多商品数据的方法。最后，展示了采集商品信息如图片、销量、地址、标题的步骤。

摘要由CSDN通过智能技术生成

pip install selenium

我采用的是利用selenium控制Chrome浏览器，所以咱们需要下载一个selenium与Chrome的桥梁——Chromedriver插件

下载与你当前谷歌浏览器版本最相近的Chromedriver

那么像我的话，下载即可。

Windows系统需下载32位，其它的自己看着办。点进去下载win32即可。

那么如何让Python与selenium连接起来呢，这里咱们需要配置一个环境变量，就是把Python与selenium处于同一个目录：

到此为止，咱们的环境就搭建好了。

分析（x0）

======

登录篇

谈谈selenium与requests的区别：

selenium：操控网页元素，模拟人去控制浏览器，放弃与底层协议的交互，控制于客户端表面（速度慢）

requests：模拟客户端像服务器发送协议请求，处于底层协议的交互。（速度快）

既然是模拟人去控制浏览器就好说了，想要采集某个网站第一步是做什么？

实例化一款需要被控制的浏览器，然后打开该网址：

from selenium import webdriver

dri

最低0.47元/天解锁文章

关注

10
点赞
踩
31

收藏

觉得还不错? 一键收藏
0
评论
【Python】完美采集淘宝数据（附完整源代码和视频教程）

我采用的是利用selenium控制Chrome浏览器，所以咱们需要下载一个selenium与Chrome的桥梁——Chromedriver插件下载与你当前谷歌浏览器版本最相近的Chromedriver那么像我的话，下载即可。Windows系统需下载32位，其它的自己看着办。点进去下载win32即可。那么如何让Python与selenium连接起来呢，这里咱们需要配置一个环境变量，就是把Python与selenium处于同一个目录：到此为止，咱们的环境就搭建好了。分析（x0）======
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。