对于python爬虫踩过的坑

本文记录了一位Python爬虫新手在使用selenium+webserver过程中遇到的问题,包括PhantomJS在Python3.5中的不兼容,Chrome版本与chromedriver匹配的重要性,cssselect的安装细节,以及环境变量设置和文件路径的困扰。通过一周的学习和尝试,最终成功运行爬虫。
摘要由CSDN通过智能技术生成

    最近由于工作原因,开始进行一些爬虫的学习。记录一下我第一个爬虫踩过的坑!

    首先感谢github给了我学习下去的动力。我使用的是python3.5,在window10下运行。爬虫用的是selenium+webserver的组合。

    问题记录:

1、开始的化想使用webdriver.PhantomJS,但是报错

所以 PhantomJS是不能刚在3.5使用的,要使用headless

 本人由于个人喜好问题,最后选用了chrome

2、在使用安装headless的时候一定要选择版本匹配。在chrome地址栏里面输入chrome://version/

这个 chrome的版本号一定要匹配chromedriver的版本。

<

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值