Python+selenium+chromedriver实现爬虫示例代码

下载好所需程序

1.Selenium简介

Selenium是一个用于Web应用程序测试的工具,直接运行在浏览器中,就像真正的用户在操作一样。

2.Selenium安装

方法一:在Windows命令行(cmd)输入pip install selenium即可自动安装,安装完成后,输入pip show selenium可查看当前的版本

方法二:直接下载selenium包:

selenium下载网址

Pychome安装selenium如果出现无法安装,参考以下博客
解决Pycharm无法使用已经安装Selenium的问题

3.禁止谷歌浏览器自动更新

搜索本地:管理工具-服务-Google自动更新服务-选择禁止

 

安装浏览器对应的驱动driver
我这里用的是谷歌,选择对应的驱动版本

驱动的下载地址如下:

http://chromedriver.storage.googleapis.com/index.html

 

win32、win64的都下载win32.zip的

将下载的chromedriver进行解压,并将文件复制或移动到,浏览器快捷方式所在目录。

环境变量配置
1.Python环境配置
2.chromedriver环境配置
3.pychrome的python环境指向自己电脑安装好的python

注意:将下载好的chromewebdriver.exe驱动放在Python的安装路径下的Scripts里面,同时将Scripts路径添加到PATH中,这样每次运行python的时候就会自动加载驱动

代码实现

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

#已经准备环境:webdriver:Google已经安装好;环境变量配置好;pip install selenium;

#selenium是一个包,包有很多对象,对象有属性,方法。

from selenium import webdriver

browser=webdriver.Chrome()#打开浏览器

url="https://news.qq.com/zt2020/page/feiyan.htm#/global?nojump=1"#获取数据的地址

#请求浏览器内容:请求方式:get,post,token

browser.get(url)

#css选择器,id选择器:#开头,class选择器:.开头,标签选择器:p,span,div。

coronavirus_countent=browser.find_element_by_class_name('d')#定位到class选择器d这个内容

print(coronavirus_countent)#查看内容,session,一种缓存机制,通过浏览器解析,然后缓存的内容

# <selenium.webdriver.remote.webelement.WebElement (session="a1aa22161543b44f599e97b35dbc1ac5", element="fe645993-43cb-46cf-83a7-2488dd3d838a")>

print(coronavirus_countent.text)#查看当前css.class中的d的内容

coronavirus_time=browser.find_element_by_class_name('ml')#定位到class选择器d这个内容

print(coronavirus_time.text)

coronavirus_data=browser.find_element_by_class_name('nowConfirm')#定位到class选择器d这个内容

print("=======")

print(coronavirus_data.text)

print("=====找nowConfirm下面的字内容")

coronavirus_sub=coronavirus_data.find_element_by_class_name('addnum')

print(coronavirus_sub.text)

browser.quit()

​现在我也找了很多测试的朋友,做了一个分享技术的交流群,共享了很多我们收集的技术文档和视频教程。
如果你不想再体验自学时找不到资源,没人解答问题,坚持几天便放弃的感受
可以加入我们一起交流。而且还有很多在自动化,性能,安全,测试开发等等方面有一定建树的技术大牛
分享他们的经验,还会分享很多直播讲座和技术沙龙
可以免费学习!划重点!开源的!!!
qq群号:485187702【暗号:csdn11】

最后感谢每一个认真阅读我文章的人,看着粉丝一路的上涨和关注,礼尚往来总是要有的,虽然不是什么很值钱的东西,如果你用得到的话可以直接拿走! 希望能帮助到你!【100%无套路免费领取】

  • 6
    点赞
  • 7
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 回答1: Python Selenium4是一个用于自动化测试的工具,可以模拟用户在网页上的操作,比如点击、输入、提交表单等。以下是一个简单的Python Selenium4项目实践代码示例: ```python from selenium import webdriver from selenium.webdriver.common.by import By from selenium.webdriver.support.ui import WebDriverWait from selenium.webdriver.support import expected_conditions as EC # 创建Chrome浏览器实例 driver = webdriver.Chrome() # 打开网页 driver.get("https://example.com") # 查找网页元素 element = WebDriverWait(driver, 10).until( EC.presence_of_element_located((By.ID, "element_id")) ) # 操作网页元素 element.click() element.send_keys("example") element.submit() # 获取网页内容 print(driver.page_source) # 关闭浏览器实例 driver.quit() ``` 以上代码首先导入了必要的模块,包括`webdriver`、`By`和`WebDriverWait`等。然后创建了一个Chrome浏览器实例,并打开了目标网页。接着使用`WebDriverWait`等待目标元素加载完成,然后执行了一系列操作,比如点击、输入和提交等。最后通过`driver.page_source`获取了网页的源代码,并打印输出。最后使用`driver.quit()`关闭浏览器实例。 这只是一个简单的示例,实际项目中可能会更加复杂,需要根据具体需求进行适当的修改和扩展。通过使用Python Selenium4,可以方便地进行网页自动化测试,并且具有丰富的API和功能,可以满足日常测试的各种需求。 ### 回答2: Python Selenium是一个强大的自动化测试工具,可以用于Web应用的测试和爬虫项目。Selenium 4是Selenium的最新版本,增加了一些新特性和改进。 以下是一个Python Selenium 4项目实践的代码示例: ```python from selenium import webdriver from selenium.webdriver.common.by import By from selenium.webdriver.support.ui import WebDriverWait from selenium.webdriver.support import expected_conditions as EC # 设置Chromedriver的路径 chrome_driver_path = '/path/to/chromedriver' # 创建一个Chrome浏览器的实例 driver = webdriver.Chrome(executable_path=chrome_driver_path) # 打开一个网页 driver.get('https://www.example.com') # 使用显式等待等待某个元素加载完成 wait = WebDriverWait(driver, 10) element = wait.until(EC.presence_of_element_located((By.ID, 'element_id'))) # 进行一些操作,比如点击按钮、输入文本等 button = driver.find_element(By.XPATH, '//button') button.click() input_box = driver.find_element(By.ID, 'input_box') input_box.send_keys('Hello, World!') # 获取网页的标题和内容 title = driver.title content = driver.page_source # 关闭浏览器 driver.quit() ``` 以上代码演示了一个简单的使用Selenium 4的项目实践。首先,需要下载并设置Chrome浏览器的驱动路径。然后,创建一个Chrome浏览器的实例,打开一个网页。使用显式等待等待页面上的某个元素加载完成。接着,进行一些操作,比如点击按钮、输入文本等。最后,获取网页的标题和内容,最后关闭浏览器。 这只是一个示例,实际的项目中可能需要更多的操作和逻辑。使用Selenium 4可以实现更多的功能,比如截图、处理弹窗、执行JavaScript等。通过深入研究Selenium 4的文档和相关资源,可以更好地实践Python Selenium项目。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值