使用selenium爬取京东商城的商品信息

本文介绍如何使用selenium库来爬取京东商城的商品信息,详细讲解了设置动态参数、模拟点击、数据解析等关键步骤,帮助读者掌握动态网站的爬取技巧。
摘要由CSDN通过智能技术生成
from selenium import webdriver
from selenium.webdriver import ChromeOptions
from selenium.webdriver.common.keys import Keys
import time

# 跳过谷歌浏览器的自动化检测
option = ChromeOptions()
option.add_argument('disable-infobars')


def get_goods(driver):
    number = 400
    # 循环拖动鼠标滚轮,使当前页的所有商品信息加载完成
    for line in range(20):
        js = 'window.scrollTo(0,%s)' % number
        number += 500
        driver.execute_script(js)
        time
好的,下面是使用Selenium爬取京东Python图书第一本书的信息的步骤: 1. 安装Selenium库和Chrome浏览器驱动。 2. 导入Selenium库和时间库: ```python from selenium import webdriver import time ``` 3. 创建浏览器对象并访问京东网站: ```python driver = webdriver.Chrome() driver.get('https://www.jd.com/') ``` 4. 找到搜索框并输入关键词“Python”。 ```python search_box = driver.find_element_by_id('key') search_box.send_keys('Python') ``` 5. 找到搜索按钮并点击。 ```python search_button = driver.find_element_by_class_name('button') search_button.click() ``` 6. 等待页面加载完成。 ```python time.sleep(5) ``` 7. 找到图书分类并点击。 ```python book_category = driver.find_element_by_xpath('//*[@id="J_cate"]/ul/li[1]/a') book_category.click() ``` 8. 等待页面加载完成。 ```python time.sleep(5) ``` 9. 找到第一本书的标题、价格和链接。 ```python book_title = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[3]/a/em') book_price = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[2]/strong/i') book_link = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[1]/a') ``` 10. 打印书籍信息。 ```python print('书名:', book_title.text) print('价格:', book_price.text) print('链接:', book_link.get_attribute('href')) ``` 11. 关闭浏览器。 ```python driver.quit() ``` 完整代码如下: ```python from selenium import webdriver import time driver = webdriver.Chrome() driver.get('https://www.jd.com/') search_box = driver.find_element_by_id('key') search_box.send_keys('Python') search_button = driver.find_element_by_class_name('button') search_button.click() time.sleep(5) book_category = driver.find_element_by_xpath('//*[@id="J_cate"]/ul/li[1]/a') book_category.click() time.sleep(5) book_title = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[3]/a/em') book_price = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[2]/strong/i') book_link = driver.find_element_by_xpath('//*[@id="J_goodsList"]/ul/li[1]/div/div[1]/a') print('书名:', book_title.text) print('价格:', book_price.text) print('链接:', book_link.get_attribute('href')) driver.quit() ``` 运行之后就可以爬取京东Python图书第一本书的信息了。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值